guías

Qué comprar para usar Ollama en casa sin tirar el dinero

Guía de compra para usar Ollama en local: cuándo basta tu portátil, cuándo conviene mini PC y cuándo merece la pena una GPU con VRAM.


La pregunta no es “qué ordenador necesito para IA local”. La pregunta útil es: qué quieres hacer con Ollama y cuánto vas a esperar cada vez que le pidas algo.

Ollama es la forma más sencilla de correr modelos de lenguaje en local. Instalas la app, descargas un modelo y hablas con él desde tu ordenador. La trampa está en el hardware: casi cualquier máquina puede arrancar un modelo pequeño, pero no todas lo hacen a una velocidad agradable.

Antes de comprar nada

Prueba primero con lo que ya tienes. Si tu ordenador tiene 16 GB de RAM, instala Ollama y ejecuta un modelo pequeño como llama3.2:3b o qwen2.5:3b. Si eso ya te sirve para resumir textos, probar prompts o hacer automatizaciones sencillas, no compres hardware todavía.

La compra empieza a tener sentido cuando aparece uno de estos problemas:

  • el modelo tarda demasiado en responder;
  • no puedes cargar modelos de 7B o superiores;
  • quieres dejar Ollama encendido 24/7;
  • quieres compartirlo con Home Assistant, scripts o varios dispositivos de casa;
  • no quieres tener tu portátil principal trabajando como servidor.

Ruta 1: portátil o sobremesa que ya tienes

Es la ruta más barata y la mejor para aprender. En CPU, un modelo de 3B puede ser suficiente para clasificar texto, resumir estados de Home Assistant o responder preguntas simples. Para modelos de 7B, 16 GB de RAM es el mínimo razonable.

Si tienes un Mac con Apple Silicon, estás en una posición bastante buena: Ollama usa Metal para acelerar en la GPU integrada. No necesitas drivers raros y la memoria unificada permite cargar modelos que en un PC dependerían de la VRAM de una tarjeta gráfica.

Compra recomendada: ninguna. Primero valida que de verdad vas a usar Ollama más de una semana.

Ruta 2: mini PC como servidor 24/7

El mini PC tiene sentido si quieres que Ollama esté siempre disponible en la red local. Es menos potente que una GPU dedicada, pero consume poco, hace poco ruido y también puede llevar Home Assistant, Node-RED, bases de datos pequeñas o un dashboard.

Busca 32 GB de RAM si puedes. Con 16 GB se puede empezar, pero se queda justo en cuanto mezclas Ollama con otros servicios. El almacenamiento NVMe también importa: los modelos ocupan varios GB y cambiar entre ellos se nota menos con SSD rápido.

En el site ya tienes ejemplos como mini PCs y servidores compactos pensados para esta función.

Ruta 3: GPU con VRAM

Si quieres respuestas rápidas con modelos de 7B, 8B o más, la VRAM manda. Para IA local, la cifra importante no es “gaming”, es cuánta memoria tiene la GPU.

Regla simple:

  • 8 GB VRAM: entrada realista para modelos de 7B cuantizados;
  • 12 GB VRAM: punto dulce barato para experimentar con margen;
  • 16 GB VRAM: mucho más cómodo para modelos más grandes o contexto largo;
  • 24 GB VRAM: terreno serio, caro, y no necesario para empezar.

NVIDIA sigue siendo la ruta menos problemática por soporte CUDA. Intel Arc y AMD han mejorado mucho, pero conviene aceptar que a veces tocará mirar drivers, Vulkan, ROCm o documentación específica. Por eso la Intel Arc B580 es interesante: 12 GB de VRAM por menos dinero, con más letra pequeña que NVIDIA.

Qué compraría según el caso

Para aprender: no compraría nada. Usaría tu ordenador actual con modelos de 3B.

Para Home Assistant y automatizaciones: mini PC con 32 GB de RAM. No necesitas una GPU enorme para clasificar eventos o resumir estados.

Para chat local cómodo: GPU con 12-16 GB de VRAM o Mac con buena memoria unificada.

Para cacharrear con modelos grandes: GPU de 24 GB o máquina con mucha memoria unificada. Es divertido, pero no es el punto de entrada sensato.

Lo que no te van a contar

La mayoría de gente compra demasiado pronto. Ollama engancha porque la instalación es fácil, pero el uso diario exige un caso real: resumir documentos, controlar Home Assistant, clasificar tickets, escribir borradores o conectar herramientas.

Si no tienes ese caso, compra tiempo: prueba una semana con hardware existente y guarda el dinero para cuando el cuello de botella sea obvio.

Veredicto

Para empezar con Ollama, no compres “el mejor hardware”. Compra solo cuando sepas qué te molesta: velocidad, memoria, ruido o disponibilidad 24/7. Si tienes que elegir a ciegas, el punto más equilibrado es un mini PC con 32 GB de RAM o una GPU de 12 GB de VRAM.