
Precios reales de la IA en 2026: cuánto cuesta usar Claude, ChatGPT, Gemini y modelos abiertos
Publicado el:
Tiempo de lectura: 11 min
Tema: Tecnologia
Autor: Leandro Valencia
Comparativa de costo real de ChatGPT, Claude, Gemini y modelos abiertos en 2026: suscripción, API y local. Tres escenarios de freelancer y pyme, y cuándo 20 dólares alcanzan.
Tabla de Contenidos
- Cómo se paga de verdad
- El costo que no sale en la landing
- Cuándo 20 dólares alcanzan
- Cómo armar el gasto
Cómo se paga de verdad
Hay tres rieles. Mezclarlos es normal. Confundirlos es caro.
Suscripción de chat. Pagas un fijo y usas la app. El techo no es “ilimitado”: es una cuota que se recarga cada pocas horas y, a veces, otra semanal. Si te pasas, el modelo baja o te empuja al plan de arriba.
API (pago por token). Pagas lo que consumes. Un token es un pedazo de texto: unas 750 palabras en español son, con holgura, mil tokens. Sale barata con prompts cortos y cara si un agente lee el repo diez veces al día. Sirve cuando ya sabes qué vas a repetir.
Local. Ollama y similares no cobran licencia. El costo es el hardware, la luz y tu tiempo de instalar. El dato no sale de tu máquina. A cambio, no esperes el modelo de frontera salvo que tengas GPU seria.
Un Plus de 20 dólares no es “la API con descuento”: es un chat con techo. Una API de 8 un mes y de 80 al siguiente no es “un plan barato”: es una factura variable. Ollama no es ChatGPT gratis: es otra categoría.
Rangos de 2026 (aprox., y se mueven)
Todo en USD de lista. En LATAM súmale conversión del banco o la fintech, posible IVA, y que el plan no esté igual de disponible en tu país.
ChatGPT (OpenAI)
- Free: para probar y tareas cortas. Te vas a topar el techo.
- Go: alrededor de 8 dólares al mes.
- Plus: 20 dólares. El default de quien trabaja con texto todos los días.
- Pro: 100 a 200 dólares, según el múltiplo de uso (en la práctica, 5x o 20x respecto de Plus).
- Business: alrededor de 25 dólares por asiento (a veces menos en anual). Admin y factura central.
La API de OpenAI es otra cuenta. Plus no te autoriza a meterla en tus sistemas como si fuera ilimitada. Si automatizas, cotiza tokens aparte.
Claude (Anthropic)
- Free: comparar tono y trabajo liviano.
- Pro: 20 dólares. El equivalente cultural de Plus.
- Max: 100 dólares (5x) o 200 (20x). Aparece cuando programas o pegas contextos largos todos los días y Pro se acaba a mitad de semana.
- Team: alrededor de 25 dólares por asiento. Hay variantes más caras si el equipo necesita más uso o herramientas de código. No todos los asientos de “equipo” incluyen lo mismo.
Claude se siente caro como agente de código todo el día. Se siente barato si lo reservas para el trabajo que necesita juicio.
Gemini (Google)
- Free: integrado a la cuenta de Google. Alcanza si ya vives en Docs y Gmail.
- AI Plus: más o menos 5 a 8 dólares, según el momento y el país. Suele traer almacenamiento extra de Google One.
- AI Pro: alrededor de 20 dólares.
- Ultra: ha oscilado; tómala en 200 a 250 dólares (a veces aparece un tramo cerca de 100). Confirma en Google.
Si ya pagas One o Workspace, mira si la IA viene incluida antes de abrir otra tarjeta.
Modelos abiertos y baratos por token
- Ollama en local: 0 de licencia. En una laptop de 16 GB corres modelos chicos y medianos, no el de frontera.
- APIs de DeepSeek, Qwen, GLM y similares: mucho más baratas por token que OpenAI o Anthropic. Órdenes de magnitud, no un 10% menos. Borradores, clasificación, código rutinario, volumen.
- OpenCode Go: alrededor de 10 dólares al mes (el primer mes a veces sale menos). No es un chat para el cliente: es un plan de modelos para programar con agente, con techos de uso. El desglose del producto está en OpenCode Go: precio, límites y si vale la pena.
“Barato por token” no es gratis. Es que el millón de tokens que en un modelo de frontera te duele, aquí a veces ni lo notas.
El costo que no sale en la landing
Límites. Los planes de 20 se acaban. Se recargan cada pocas horas, pero si trabajas en bloque —una mañana de código o diez piezas el mismo día— vas a ver el aviso. El de 100 o 200 no es más inteligente: es más cuota.
Tiempo. Esperar el reset, reescribir porque el modelo gratis se puso vago, o copiar el hilo a otra herramienta son horas. A tarifa freelance, una hora perdida ya pagó la diferencia entre Free y Plus.
Lock-in. Custom GPTs, Projects, Gems e historiales largos viven en un proveedor. Cambiar duele más que los 20 dólares. No guardes ahí la única copia de briefs y prompts con los que trabajas.
Calidad. El modelo barato te ahorra plata y te cobra en revisión. Si publicas sin editar, el ahorro es ficticio.
Pagar en dólares desde LATAM. Recargo del banco, IVA si aplica, y el “el cobro falló” a mitad de mes. Un plan de 20 puede terminar más cerca de 25–30 en moneda local.
Una cuenta, cinco personas. Compartir Plus viola términos, mezcla chats de clientes y te deja sin responsable cuando alguien pega de más. Sale barato hasta el primer susto.
Tres escenarios
Los recuentos son de orden de magnitud. Sirven para ubicar el tramo, no para cotizar.
1. Escribes 10 textos a la semana
Cuarenta piezas al mes. Si cada una son 4 a 8 idas y vueltas (brief, outline, borrador, dos recortes), estás en 160 a 320 mensajes, la mayoría cortos.
- Free o Go (~0–8 USD) alcanza si los textos son cortos, no pegas PDFs enormes y aceptas esperas.
- Plus / Pro de 20 (ChatGPT, Claude o Gemini) es el punto dulce: mejor modelo, menos fricción, archivos. Para un redactor o marketero solo, este es el techo razonable.
- API barata (DeepSeek/Qwen/GLM): si ya tienes plantilla in / borrador out, el variable baja a unos pocos dólares —a veces centavos— y reservas el chat de 20 para la edición fina.
- Local: reescribir y resumir sin mandar el brief del cliente a la nube. No esperes que te arme la pieza mejor que el de 20.
Aquí 20 dólares sí alcanzan. Subir a 100 solo tiene sentido con documentos muy largos todos los días, investigación pesada o imagen/video a volumen (eso último vive en otros cupos).
2. Programas todos los días
Aquí se rompe el plan de 20. Un agente que lee el repo, corre tests e itera no chattea: se come contexto. Una tarde de refactor puede gastar lo que un redactor gasta en dos semanas.
- Un solo Plus/Pro de 20 funciona si programas con la IA, no a través de ella: una pregunta, un archivo, un test. Si el agente está prendido todo el día, te quedas corto a mitad de mes. No es falta de disciplina; es el diseño del plan.
- Max / Pro de 100–200 tiene sentido si tu hora facturable es alta y el cuello de botella es la cuota, no tu criterio. Antes de saltar, cuenta cuántos días del mes te frenó el límite de verdad.
- Mezcla barata + 20: API abierta o OpenCode Go (~10 USD) para el código rutinario, y un Claude o ChatGPT de 20 para arquitectura y PRs que no puedes mandar a ciegas. Es la lógica de diversificar proveedores de IA: no quemar el modelo caro en autocomplete.
- API de frontera todo el día: puede salir más cara que Max. Pon alerta de gasto el primer día, no cuando llega el mail de 180 dólares.
- Local: bueno para completar y para código que no puede salir. Flojo como único cerebro en una laptop de oficina y un repo grande.
20 dólares a menudo no alcanzan si la IA es tu entorno de trabajo. Alcanzan si es un consultor al que llamas, no el IDE.
3. Equipo de 4
Cuatro Plus en correos personales son 80 dólares más el caos: nadie sabe qué se pegó, no hay factura a nombre de la empresa, y el día que se va alguien se lleva el historial.
- 4 × 20 personales: el número se ve bien. El riesgo no.
- Business / Team ~25 USD por asiento: alrededor de 100 dólares al mes. Pagas admin, baja de accesos y, en general, reglas distintas sobre entrenamiento con tus datos. Confírmalo en el contrato del plan, no en un hilo.
- 2 asientos de 20–25 + APIs baratas + un local: sirve cuando no los cuatro hacen el mismo trabajo.
- Un Pro/Max de 100–200 compartido: mala idea. Cuota, confidencialidad y responsabilidad se pisan.
El salto que importa no es de 20 a 25 por cabeza. Es pasar de cuentas personales a un espacio que la empresa pueda apagar.
Cuándo 20 dólares alcanzan
Alcanzan si eres una persona, el trabajo cabe en chats de tamaño humano (textos, mails, investigación, código por archivo) y no te quedas sin cuota más de un par de tardes al mes. El upgrade a 100, en ese caso, es vanidad o miedo.
No alcanzan si programas con agente varias horas al día, pegas repos o bases como si el contexto fuera gratis, cuatro personas comparten un login, el modelo de 20 te obliga a rehacer el trabajo, o los datos del cliente no pueden entrar a un plan de consumidor.
Tiras plata si pagas 100–200 y el 80% de tus prompts son “pásame esto a tono formal”. Eso lo hace un modelo de 10 o uno local. El plan caro se justifica por las tareas caras, no por el logo en la pestaña.
También tiras plata si apilas Plus + Claude Pro + Gemini Pro “por si acaso”. Un chat principal. El segundo, cuando el primero se acaba o es claramente mejor en tu oficio. El tercero, casi nunca.
Cómo armar el gasto
- Mide dos semanas en gratis o en 20. Anota los días que te frenó el límite y las tareas que sí salieron mejor con el modelo caro.
- Separa chat de API. El chat es para pensar. La API es para repetir. Si copias el mismo prompt 40 veces, ya es un flujo, y el flujo se paga por token barato.
- Pon techo a la API el día que creas la clave. Sin alerta no es flexible: es una tarjeta abierta.
- No compres hardware para “ahorrar la suscripción” salvo que lo necesites por privacidad o volumen.
- Paga en un medio que puedas cortar.
Si programas y estás entre un Max de 100 y un combo barato, la estrategia de capas está en por qué no depender de un solo proveedor.
Preguntas frecuentes
¿Con el plan gratis se puede trabajar en serio?
Se puede empezar. No se puede depender. Si la IA te ahorra una hora a la semana, el plan de 20 ya se pagó a cualquier tarifa freelance razonable de LATAM.
¿Plus, Claude Pro o Gemini a 20?
El mismo tramo de costo. Elige el chat que ya usas, el que menos te hace reescribir y dónde están tus archivos. Si en dos semanas no notas diferencia, quédate con el que pagas más fácil.
¿La API no es siempre más barata?
No. Es más barata en tareas repetidas y cortas. Es más cara cuando un agente da vueltas con contexto largo. La suscripción es un buffet con portero. La API es a la carta.
¿Ollama me ahorra los 20 dólares?
Sí, si el hardware alcanza y el dato no puede salir. No, si tu trabajo es “que quede bien a la primera” y tu máquina tiene 8 GB. El tiempo de montarlo también cuenta.
El precio real no es el número de la home. Es suscripción + API + tiempo + quedarte amarrado, en tu moneda y a tu tarifa por hora. Empieza en 20 si el gratis te frena. Sube a 100 cuando puedas señalar los días en que el límite te costó dinero. Si un solo proveedor se te acaba, a veces el arreglo es repartir la carga o un plan barato de modelos abiertos para código.
Posts Relacionados
Continúa explorando contenido similar que te puede interesar

Seguridad y privacidad al usar IA en tu empresa: qué datos no debes compartir con ChatGPT o Claude
Qué no pegar en ChatGPT o Claude si evalúas adoptar IA en tu empresa: credenciales, clientes, salud, menores y contratos. Plan consumer vs Team, cuentas personales y una política de una página.

Automatización sin código con IA: n8n, Zapier y Make para negocios pequeños
n8n vs Zapier vs Make para un negocio chico: qué eliges si no programas, tres flujos reales con IA, cuándo no automatizar y cómo pensar el costo a 100 y a 5.000 tareas al mes.

9 herramientas de IA que deberías estar usando (y para qué sirve cada una)
Guía práctica de 9 herramientas de IA —ChatGPT, Qwen, Codex, Ollama, Google Flow, Vibes, Perchance y Treblo— con qué hace cada una, para quién es, cuánto cuesta y cuándo tiene sentido abrirla.