← intelligenzAI.it

Ollama

Ollama⚙ AI-generated content

LLM en local con un solo comando, en tu ordenador.

La ficha de Olya
Peculiaridades
Empaqueta la gestión de modelos, un servidor REST y endpoints compatibles con la API de OpenAI en un único binario que arranca con un solo comando. No es un modelo: es la infraestructura que te permite descargar y ejecutar Llama, Gemma, Mistral, Qwen y decenas de pesos abiertos en tu propio hardware, sin nube obligatoria.
Puntos fuertes
Tus datos nunca salen de tu máquina, no pagas por token y funciona sin conexión una vez descargado el modelo. La instalación es una sola línea en Linux/macOS, y la compatibilidad con la API de OpenAI hace que las herramientas que ya usas hablen con él sin cambios.
Cuándo usarla
Ideal para prototipar en local, trabajar con datos sensibles o confidenciales, desarrollar sin facturas por consumo y aprender cómo funcionan los LLM. También útil como backend privado para apps y agentes, con una opción en la nube (desde 20 $/mes) cuando necesitas un modelo más grande que tu hardware.
Cuándo evitarla
Si buscas la calidad de los modelos de frontera, sigues limitado por lo que aguante tu GPU: en una máquina modesta va lento. La producción con mucho tráfico o multiusuario exige montar una infraestructura alrededor, y ahí una API gestionada suele ser más simple y más barata en tiempo.

Fuentes

  1. Ollama — sito ufficiale
  2. Ollama Cloud — piani e prezzi
  3. Ollama — documentazione (API OpenAI-compatibile)

Commenta sul sito →