Precio de Ollama (2026): $0 en local, Pro por $20 y Team desde $125
El precio de Ollama es $0 en local, $20 al mes con Pro y un mínimo de $125 al mes con Team. Compare límites, consumo adicional y costo de hardware.

El precio de Ollama es de $0 para uso local ilimitado, $20 al mes con Pro y al menos $125 al mes con Team. Free es la opción inicial adecuada si el modelo cabe en el hardware que ya tiene; Pro conviene cuando la capacidad en la nube cuesta menos que una máquina nueva, mientras que Team solo justifica su sobreprecio cuando importan la facturación y los controles compartidos. Todos los precios y límites de esta guía se verificaron en la página oficial de Ollama el 23 de agosto de 2026.
Precio de Ollama: planes y costos de un vistazo
Para trabajar en local, la opción predeterminada es Free. Si la demanda en la nube todavía es incierta, conviene Pro mensual; Pro anual solo tiene sentido cuando hay certeza de mantenerlo durante más de 10 meses. Max no admite nuevos compradores por ahora y Team parte de un mínimo de cinco usuarios, no de uno solo.
Ollama reúne en un mismo producto la inferencia local —el modelo se ejecuta en hardware bajo su control— y la inferencia alojada en la nube. Por eso es correcto decir que puede costar tanto «$0» como «$125 al mes». La página oficial de precios de Ollama es la fuente de referencia.

El precio anunciado solo cuenta la mitad de la historia. Ollama no publica una cantidad fija de tokens para Free, Pro o Max. El consumo depende del modelo y de los tokens de entrada, entrada en caché y salida. El multiplicador de 50x sirve para comparar planes, pero no permite saber cuántas sesiones de programación, informes o ejecuciones de agentes caben en cada uno.

¿Ollama es gratis?
Sí. El software local de Ollama cuesta $0 y permite ejecutar modelos sin límite en hardware propio. La cuenta Free también incluye un uso ligero de la nube con un solo modelo en la nube a la vez.
Son dos formas distintas de hablar de algo gratis. El uso local no genera cargos de Ollama porque el equipo aporta la capacidad de cómputo. Free en la nube utiliza la infraestructura de Ollama y, aunque cuesta $0, tiene límites que dependen del modelo. Si llega una solicitud cuando el único cupo de ejecución simultánea está ocupado, queda en cola; si la cola está llena, las solicitudes nuevas se rechazan hasta que haya capacidad.
El uso local gratuito es la ventaja que perdura. Si la máquina disponible ya ejecuta el modelo necesario a una velocidad aceptable, el costo del software puede mantenerse en $0. El hardware, el almacenamiento, la electricidad, las actualizaciones y el tiempo de operación siguen por cuenta del usuario, pero no hace falta una suscripción para continuar generando en local.
Conviene entender Free en la nube como un margen para evaluar y absorber picos. Ollama lo describe como uso ligero, no como una cifra fija de tokens. Los límites de sesión se restablecen cada 5 horas y los semanales, cada 7 días. Alcanza para comprobar si un modelo más grande en la nube sirve para el trabajo, pero no aporta datos suficientes para prometer un volumen de producción.
Quién no necesita pagar nunca: un profesional técnico que trabaja por su cuenta, usa modelos públicos en hardware que ya posee, mantiene el trabajo en local y solo recurre de vez en cuando a la nube puede seguir con Free indefinidamente. Pagar empieza a tener sentido cuando un modelo más grande no cabe, la máquina local es demasiado lenta o se necesitan varias tareas en la nube al mismo tiempo.
Ollama Pro cuesta $20 al mes o $200 al año
Pro es el plan de pago más práctico para una persona: por $20 al mes aporta más capacidad en la nube sin convertir la compra de hardware en otro proyecto. Incluye 50x el uso en la nube de Free, tres modelos en la nube concurrentes, acceso a modelos más grandes y la posibilidad de subir y compartir modelos privados.
El punto de equilibrio del plan anual es muy claro:
- Doce pagos mensuales cuestan $240.
- La facturación anual cuesta $200.
- El ahorro anual es de $40.
- El precio anual equivale a 10 pagos mensuales.
Por eso, Pro anual solo conviene si se espera utilizarlo después del mes 10. A los 10 meses exactos, ambas opciones cuestan lo mismo. Si el proyecto podría terminar antes, el plan mensual permite salir por menos dinero, aunque su total para un año completo sea mayor.
Pro también admite consumo adicional. Ollama gasta primero la asignación incluida y después descuenta del saldo que añade el usuario. Así, una semana intensa no obliga a cambiar de plan, pero la suscripción deja de ser un gasto fijo y pasa a generar un cargo variable cuando se agota el fondo incluido.
Ollama Max cuesta $100, pero las altas están en pausa
Max no está disponible para nuevos suscriptores, de modo que un comprador nuevo debería excluirlo de su presupuesto en vez de asumir que $100 al mes garantizan esa capacidad. Ollama señala que la pausa es temporal mientras amplía su capacidad. Los suscriptores actuales de Max conservan el precio, los límites y el plan.
Para esos suscriptores, Max ofrece 10 modelos en la nube concurrentes y 5x el uso de Pro. El precio también es 5x los $20 mensuales de Pro. Si solo se considera el multiplicador publicado por Ollama, Max no ofrece un descuento por volumen sobre el uso incluido. Su ventaja práctica está en pasar de tres modelos en la nube concurrentes a 10 y en sostener trabajo intenso y continuo.
La consecuencia empresarial es sencilla: quien planee lanzar varios agentes permanentes no puede depender de Max hoy. Las alternativas disponibles son Pro con consumo adicional, una opción con cobro por uso o infraestructura local. Esperar a Max sin una vía alternativa convierte el estado de una página de precios en un riesgo de despliegue.
Ollama afirma que el volumen de tokens en la nube se ha más que duplicado cada mes, razón por la que pausó las suscripciones nuevas de mayor consumo. Es una señal de demanda, pero también de que la capacidad sigue siendo una limitación activa. Los suscriptores actuales deberían mantener una segunda vía para ejecutar modelos en los trabajos que no pueden esperar en una cola.
Ollama Team parte de $125 al mes
Team cuesta $25 por usuario al mes y exige un mínimo de cinco usuarios. La factura más pequeña posible es, por tanto, de $125 al mes o $1,500 durante 12 meses. Aparece como precio introductorio y continúa bajo lista de espera.
La comparación útil no es $25 frente a $20, sino la factura mínima real para un grupo:
- Cinco cuentas Pro mensuales cuestan $1,200 durante 12 meses. Team cuesta $300 más.
- Cinco cuentas Pro anuales cuestan $1,000. Team cuesta $500 más.
Esos $500 son la prima anual por los controles de Team en su configuración mínima. A cambio se obtiene una cuenta de equipo independiente, facturación y administración compartidas, uso incluido por usuario, un saldo común para consumo adicional, soporte prioritario y retención y registro de datos igual a cero. Cada usuario adicional de Team suma $25 al mes.
La decisión cambia cuando esos controles eliminan más de $500 al año en coordinación o riesgo. Una startup de cinco personas que trabaje bien con cuentas personales separadas debería ahorrarse los $500. Un grupo regulado que necesite una sola factura, uso controlado, soporte y una separación formal del equipo puede justificarlo con rapidez.
No conviene comprar Team por funciones que aún son promesas. Ollama marca como próximas el inicio de sesión único, los controles de acceso a modelos y los instaladores para administrar dispositivos Windows y macOS. No son prestaciones incluidas actualmente en la página oficial.
Enterprise tiene precio personalizado. Añade condiciones por volumen, apoyo en seguridad y compras, y planificación del despliegue. Es una vía de negociación, no un plan que pueda reducirse a un precio público por usuario.
El consumo adicional revela el costo real de la API de Ollama
El precio de la suscripción de Ollama es predecible hasta que se agota el uso incluido; a partir de ahí, importa la tarifa de tokens del modelo. Pro y Max permiten añadir saldo para consumo adicional, mientras que Team descuenta los excesos de un saldo compartido. Los administradores de Team pueden desactivar el cobro automático por uso.
La API directa en la nube no tiene un plan de suscripción propio publicado por separado. La documentación de Ollama Cloud utiliza la misma cuenta y una clave de API para llamar a modelos en ollama.com. En la práctica, la distinción es esta: la API local tiene un costo de software de $0 y el uso de la API en la nube se carga al plan de la cuenta y a su saldo adicional.
Kimi K3 permite poner cifras concretas al consumo adicional. Su página oficial del modelo en Ollama indica:
- $3.00 por 1 millón de tokens de entrada, o $0.003 por 1,000.
- $0.30 por 1 millón de tokens de entrada en caché, o $0.0003 por 1,000.
- $15.00 por 1 millón de tokens de salida, o $0.015 por 1,000.
Una tarea con 100,000 tokens de entrada sin caché y 10,000 tokens de salida cuesta $0.45 con esas tarifas: $0.30 por la entrada y $0.15 por la salida. Ese sí es un costo por resultado válido para el consumo adicional. No es el costo de una tarea en Pro mientras quede capacidad incluida, porque Ollama no publica la cantidad fija de tokens incluida en Pro.
Ollama puede enviar un recordatorio opcional al alcanzar el 90% del límite del plan. Los créditos de consumo adicional comprados vencen un año después de añadirse, de modo que un saldo preventivo demasiado grande puede desperdiciarse. Conviene cargar solo lo que probablemente consumirá la siguiente carga de trabajo.
El hardware local solo supera a Pro si la máquina ya se aprovecha
Con hardware existente, ejecutar Ollama en local es difícil de superar: el costo del software permanece en $0. Comprar una máquina nueva únicamente para evitar una suscripción de $20 resulta mucho menos atractivo.
Cada $1,000 de costo incremental en hardware equivale a 50 meses de Pro, antes de sumar electricidad, almacenamiento, mantenimiento o tiempo del operador. El cálculo es deliberadamente sencillo: $1,000 divididos entre $20 al mes. A ese ritmo, una compra dedicada tarda más de cuatro años en amortizarse frente a Pro, y el modelo deseado podría cambiar antes de recuperar la inversión.
La palabra incremental es importante. Si una mejora de $1,000 también sustituye una estación de trabajo anticuada, sirve para tareas de diseño o ingeniería y ejecuta modelos locales, atribuir el importe completo a Ollama exageraría el costo de la IA. Solo debe asignarse la parte comprada específicamente para inferencia.
El trabajo local sigue ganando por razones que una comparación de suscripciones no puede valorar. Los datos pueden permanecer en hardware bajo su control, el uso de modelos locales es ilimitado y una ruta sin conexión que funciona no depende de una cola en la nube. Estas ventajas pueden pesar más que un punto de equilibrio financiero lejano cuando la privacidad, la disponibilidad o el volumen de experimentación son el requisito real.
Pro gana cuando se necesita un impulso temporal, un modelo más grande o un gasto operativo claro. Pague $20 durante un mes, observe qué tareas alcanzan los límites y solo entonces valore el plan anual o el hardware. Comprar una máquina antes de medir la carga de trabajo convierte la incertidumbre en un costo hundido.
Precios de Ollama frente a LM Studio y OpenRouter
LM Studio es la alternativa más clara para trabajo irregular en la nube con pago por uso, mientras que OpenRouter ofrece más amplitud para enrutar entre muchos proveedores. Ollama Pro gana cuando su capacidad incluida absorbe una carga constante y resulta útil mantener el mismo flujo entre el entorno local y la nube.
LM Studio: $0 en local y nube por consumo
LM Studio cobra $0 por los modelos locales y la transcripción de voz en una máquina propia; la inferencia en la nube se compra después mediante créditos de pago por uso. Su plan Free incluye LM Link para un máximo de cinco dispositivos. Bionic Pass aparece como próximo, todavía sin precio publicado.

La comparación más limpia utiliza el mismo modelo. LM Studio publica para Kimi K3 una tarifa de $3.00 por 1 millón de tokens de entrada, $0.30 por 1 millón de tokens de entrada en caché y $15.00 por 1 millón de tokens de salida: exactamente las mismas cifras que aparecen en la página de Kimi K3 en Ollama. El costo bruto por consumo es idéntico; la forma de empaquetarlo decide cuál conviene.
Elija LM Studio Cloud si el uso es esporádico y quiere que cada token se descuente de un saldo de créditos visible. Elija Ollama Pro si es probable que el uso habitual incluido cubra todo el mes y prefiere el flujo unificado de Ollama para modelos locales y en la nube. Para decidir el entorno de ejecución con más detalle, la comparativa de alternativas a Ollama separa las herramientas de escritorio de los servidores de producción.
OpenRouter: sin suscripción mínima, pero con comisión por créditos
OpenRouter ofrece acceso de pago por uso a más de 500 modelos de más de 80 proveedores, sin gasto mínimo. Al comprar créditos cobra una comisión del 5.5%, sujeta a un mínimo de $0.80, y traslada los precios de inferencia de cada modelo.

Comprar $100 en créditos utilizables cuesta $105.50 antes de impuestos cuando se aplica la comisión del 5.5%. Así, el costo de la plataforma queda explícito. El plan Free ofrece más de 25 modelos gratuitos de cuatro proveedores y permite 50 solicitudes al día; esos límites lo convierten en una vía de evaluación, no en capacidad fiable para producción.
Elija OpenRouter si la variedad de modelos, el enrutamiento entre proveedores y una factura basada en el uso importan más que la ejecución local. Elija Ollama si ejecutar en local forma parte del diseño y la nube amplía ese mismo flujo. El desglose de precios de OpenRouter explica su comisión con más detalle; la comparativa de las API de IA más baratas es el mejor paso siguiente cuando no encaja ningún formato de suscripción.
La regla explícita es esta: para un uso individual constante que cabe en Ollama Pro, conviene Ollama; para consumo irregular de tokens, LM Studio; para enrutar producción entre varios proveedores, OpenRouter. Ninguno es el más barato para todas las cargas de trabajo porque sus unidades de facturación son distintas.
Los costos ocultos en el precio de Ollama
El mayor costo oculto es la incertidumbre, no un cargo sorpresa. Las cuotas incluidas en la nube se expresan como consumo relativo, pero el gasto real cambia según el modelo y la combinación de tokens. La factura mensual es predecible; la cantidad de trabajo que entrega esa factura, menos.
También hay que incorporar estas condiciones al presupuesto:
- Las suscripciones de pago se renuevan automáticamente si no se cancelan antes de la renovación.
- Los clientes son responsables de los impuestos aplicables.
- Los créditos comprados para consumo adicional vencen después de un año.
- Las nuevas suscripciones a Max están en pausa y Team tiene lista de espera.
- Los modelos en la nube pueden retirarse conforme aparecen otros más nuevos. Ollama indica que avisará a los usuarios afectados, pero las aplicaciones podrían necesitar un cambio de modelo.
- Las solicitudes que superan el límite de concurrencia quedan en cola; si la cola está llena, el trabajo adicional se rechaza.
- Las Condiciones actuales explican la cancelación, pero no prometen un plazo estándar de reembolso.
El punto del reembolso exige precisión. Ollama no afirma que todos los pagos sean no reembolsables, pero tampoco publica un derecho habitual a reembolso en sus Condiciones actuales. Si una compra anual depende de un modelo o nivel de capacidad concreto, confirme con soporte la vía de excepción antes de pagar.
- El uso local se mantiene en $0 y es ilimitado en hardware propio
- Pro tiene un precio de entrada claro de $20 al mes y un ahorro anual real de $40
- Un mismo producto abarca modelos locales, modelos alojados en la nube, CLI y acceso directo por API
- El consumo adicional permite superar la asignación incluida
- Las cuotas incluidas en la nube no se publican como cantidades fijas de tokens
- Max no está disponible para nuevos suscriptores y Team continúa en lista de espera
- Team parte de $125 al mes aunque solo se necesite un control compartido
- Los créditos de consumo adicional vencen después de un año y no se promete un plazo estándar de reembolso
Evite por completo los planes de pago de Ollama si el hardware disponible cumple la tarea. No contrate Pro anual hasta que sea probable llegar al undécimo mes. Evite Team si cinco cuentas Pro anuales independientes son viables en la operación. No use Ollama Cloud para un flujo crítico que no pueda tolerar una cuota opaca, una cola o la retirada de un modelo sin contar con una alternativa.
Qué hacer este lunes
Empiece con una revisión presupuestaria de una semana, no con la compra de hardware ni un compromiso anual.
Use la máquina que ya tiene
Ejecute el modelo local previsto en el hardware existente. Si cumple el objetivo, mantenga el presupuesto de software en $0 y registre únicamente los costos reales de infraestructura y operación.
Pruebe Free en la nube durante ambos ciclos de restablecimiento
Ejecute la carga de trabajo real dentro de una ventana de sesión de 5 horas y una ventana semanal de 7 días. Registre el modelo elegido, la concurrencia, las colas y el punto en que el trabajo se detiene. No convierta el resultado en una cuota universal de tokens.
Compre un mes de Pro antes de comprometerse
Si Free impide hacer trabajo útil, pague $20 por Pro y vuelva a medir. La facturación anual solo mejora el total después de 10 pagos mensuales, así que la incertidumbre debe quedarse en el plan mensual.
Calcule por separado el costo de los controles
Para cinco personas, compare el mínimo anual de Team de $1,500 con los $1,000 de cinco cuentas Pro anuales. Entre en la lista de espera de Team solo si la facturación compartida, la administración, el soporte y los controles de datos valen la diferencia de $500.
Esta secuencia mantiene el presupuesto reversible. Free confirma si el hardware es suficiente, Pro mensual pone a prueba el ajuste de la nube, Pro anual premia la permanencia y el sobreprecio de Team cubre la gobernanza, no una inferencia más barata.
Preguntas frecuentes
¿Ollama es gratis?
Sí. El uso local cuesta $0 y es ilimitado en hardware propio. Ollama también incluye uso ligero en la nube con Free, un solo modelo en la nube a la vez y límites que dependen del modelo.
¿Ollama cuesta dinero?
Solo al elegir capacidad de pago en la nube o comprar infraestructura. Pro cuesta $20 al mes o $200 al año, Max figura por $100 al mes pero no admite altas nuevas y Team parte de $125 al mes.
¿Ollama ofrece descuento para estudiantes?
Ollama no publica un descuento específico para estudiantes en su página de precios actual. Los estudiantes pueden usar el plan Free de $0 o pagar la tarifa estándar de Pro.
¿Cuál es la política de reembolso de Ollama?
Las Condiciones actuales de Ollama explican la cancelación y la renovación automática, pero no prometen un plazo estándar de reembolso. Confirme cualquier caso excepcional con soporte antes de contratar la facturación anual.
¿Cambió el precio de Ollama en 2026?
El cambio relevante actual es la disponibilidad: las altas nuevas de Max están en pausa, mientras que los suscriptores actuales conservan su precio y sus límites. Team también figura con precio introductorio y continúa en lista de espera.
¿Cómo funciona el precio de la API de Ollama Cloud?
La API directa en la nube utiliza una cuenta de Ollama y una clave de API dentro del mismo plan de nube. El uso incluido depende del modelo; al agotarse, el saldo adicional se cobra según las tarifas de tokens del modelo elegido.
¿Ollama necesita una GPU?
Los modelos locales utilizan hardware propio, por lo que el tamaño del modelo y la velocidad aceptable determinan si la máquina es suficiente. Ollama Cloud ejecuta los modelos grandes en infraestructura alojada y permite usarlos sin comprar una GPU local potente.
¿Quiere saber qué tarea empresarial encaja con cada herramienta del ecosistema? Consulte el mapa de herramientas de IA para empresas y reciba un resumen semanal conciso de lo que cambió y de lo que merece atención.
2 sept 2026







