Guía práctica de precios de septiembre de 2026 para los principales modelos y suscripciones de IA. Compara planes para consumidores, planes ...

Comparar los precios de la IA parece sencillo hasta que se colocan tres modelos de facturación completamente distintos en la misma tabla.
El primero es la suscripción a una aplicación para consumidores. Pagas mensualmente por una interfaz lista para usar con funciones como chat, búsqueda, gestión de archivos, investigación, presentaciones, memoria y flujos de trabajo con agentes.
El segundo es un plan de programación o de tokens. También suele facturarse mensualmente, pero el importe compra una cuota o un conjunto de créditos que normalmente está restringido a las herramientas oficiales de programación del proveedor, sus productos de agentes o sus integraciones compatibles.
El tercero es el uso de API de pago por consumo. Pagas por los tokens de entrada y salida, y esta es la vía habitual cuando el modelo debe integrarse en tu propio producto, aplicación, backend o servicio orientado al cliente.
Estas tres cuentas pueden costar decenas o cientos de dólares al mes, pero no son intercambiables.
Una suscripción de ChatGPT no incluye el uso normal de la API de OpenAI. Un plan de programación puede ser más barato que la facturación por API para un desarrollador, pero no ser adecuado para un servicio en producción. Una API puede parecer cara por millón de tokens, pero ser la única opción que ofrece a una empresa la concurrencia, observabilidad, facturación y control de integración que necesita.
Esta guía mantiene la estructura del artículo original y convierte los precios dispersos en una referencia más útil para las decisiones de compra.
Nota sobre los precios: Los precios cambian con frecuencia. Algunos planes son regionales, promocionales o no están disponibles temporalmente. Las tablas siguientes reflejan la instantánea de precios del 18 al 20 de septiembre de 2026 y se han contrastado con las páginas oficiales de precios cuando estaban disponibles.
Las suscripciones para consumidores son la opción más sencilla cuando una persona solo quiere utilizar la aplicación oficial.
| Proveedor | Nivel gratuito | Nivel inicial | Nivel principal | Nivel individual más alto |
|---|---|---|---|---|
| OpenAI ChatGPT | Gratis | Go, 8 $/mes en Estados Unidos | Plus, 20 $/mes | Pro, 100 $; Pro, 200 $ para suscriptores existentes |
| Anthropic Claude | Gratis | Pro, 20 $/mes o 200 $/año | Max 5x, 100 $/mes | Max 20x, 200 $/mes |
| Google Gemini | Gratis | AI Plus, precio regional | AI Pro, 19,99 $/mes en Estados Unidos | AI Ultra, 99,99 $/mes en Estados Unidos |
| xAI Grok | Gratis | — | SuperGrok, 30 $/mes | SuperGrok Plus, 100 $/mes |
| Perplexity | Gratis | Planes educativos o con descuento cuando corresponda | Pro | Max |
Actualmente, OpenAI ofrece los niveles para consumidores Free, Go, Plus y Pro.
En Estados Unidos:
Existe una salvedad importante en septiembre de 2026: OpenAI pausó temporalmente las nuevas altas y actualizaciones a Pro de 200 $ el 10 de septiembre. Los suscriptores actuales de Pro de 200 $ no se ven afectados, y Pro de 100 $ sigue disponible.
Actualmente, los usuarios de Free y Go utilizan GPT-5.6 Luna para la experiencia estándar de ChatGPT, mientras que los planes de pago elegibles pueden acceder a GPT-5.6 Sol. GPT-6 Pro, basado en GPT-6 Astra, está disponible en los planes Pro, Business y Enterprise elegibles.
Los precios individuales de Claude son claros:
Pro incluye Claude Code, Cowork, Design y un acceso más amplio a los modelos. Los planes Max aumentan principalmente los límites de uso y el acceso prioritario.
Los precios de Google AI varían según el mercado, pero la página de precios actual de Estados Unidos indica:
Google AI Plus existe como nivel inferior, pero el precio mostrado puede variar según el país y no aparece de forma uniforme en todas las páginas regionales de precios.
Los planes combinan el acceso a Gemini con almacenamiento de Google y otros servicios de Google, por lo que no deben compararse como si fueran suscripciones puras basadas en tokens.
La página actual de precios para consumidores de xAI indica:
Esto difiere de los nombres y precios de planes antiguos que todavía circulan por internet. Para tomar decisiones de compra, utiliza la página de precios activa de xAI en lugar de una tabla comparativa antigua.
Para la integración en productos, los precios de la API importan más que las suscripciones para consumidores.
La tabla siguiente muestra las tarifas estándar para contextos cortos más relevantes para la contratación habitual de API.
| Proveedor | Modelo | Entrada | Entrada en caché | Salida |
|---|---|---|---|---|
| OpenAI | GPT-6 Astra | 10,00 $ | 1,00 $ | 50,00 $ |
| OpenAI | GPT-5.6 Sol | 4,00 $ | 0,40 $ | 20,00 $ |
| OpenAI | GPT-5.6 Terra | 2,00 $ | 0,20 $ | 12,00 $ |
| OpenAI | GPT-5.6 Luna | 0,20 $ | 0,02 $ | 1,20 $ |
| Anthropic | Claude Fable 5.1 | 10,00 $ | 0,25 $ | 50,00 $ |
| Anthropic | Claude Opus 5 | 5,00 $ | 0,50 $ | 25,00 $ |
| Anthropic | Claude Sonnet 5 | 2,00 $ | 0,20 $ | 10,00 $ |
| Anthropic | Claude Haiku 4.5 | 1,00 $ | 0,10 $ | 5,00 $ |
| Gemini 3.5 Flash | 1,50 $ | 0,15 $ | 9,00 $ | |
| Gemini 3.1 Pro Preview, menos de 200 K de entrada | 2,00 $ | — | 12,00 $ | |
| Precio introductorio de Gemini 3.8 Flash | 0,75 $ | 0,075 $ | 3,75 $ | |
| xAI | Grok 4.6 | 2,00 $ | 0,50 $ | 6,00 $ |
| xAI | Grok 4.3 | 1,25 $ | 0,20 $ | 2,50 $ |
La tabla de OpenAI del artículo original coincide en términos generales con los precios oficiales actuales.
Las tarifas estándar actuales para contextos cortos son:
GPT-6 Astra 10 $ de entrada / 50 $ de salida
GPT-5.6 Sol 4 $ de entrada / 20 $ de salida
GPT-5.6 Terra 2 $ de entrada / 12 $ de salida
GPT-5.6 Luna 0,20 $ de entrada / 1,20 $ de salida
Estos precios corresponden a 1 millón de tokens.
La tarifa de 4 $/20 $ de GPT-5.6 Sol es promocional y está disponible al menos hasta el 21 de noviembre de 2026. Las solicitudes con contexto largo también pueden tener precios diferentes, por lo que una hoja de cálculo de compras no debe asumir que todas las solicitudes utilizan la tarifa para contextos cortos.
Los precios actuales de primera parte de Anthropic son:
Claude Fable 5.1 10 $ de entrada / 50 $ de salida / 0,25 $ por acierto de caché
Claude Opus 5 5 $ de entrada / 25 $ de salida / 0,50 $ por acierto de caché
Claude Sonnet 5 2 $ de entrada / 10 $ de salida / 0,20 $ por acierto de caché
Claude Haiku 4.5 1 $ de entrada / 5 $ de salida / 0,10 $ por acierto de caché
Una corrección útil frente a las tablas comparativas antiguas es que los aciertos de caché de Fable 5.1 cuestan 0,25 $ por millón de tokens, no 1,00 $.
Anthropic también ofrece descuentos para procesamiento por lotes y precios independientes para la escritura en caché, por lo que el coste efectivo de una carga de trabajo de agentes con contexto largo puede diferir considerablemente de las cifras principales de entrada y salida.
Actualmente, Gemini 3.8 Flash tiene los siguientes precios:
0,75 $ por 1 millón de tokens de entrada
0,075 $ por 1 millón de tokens de entrada en caché
3,75 $ por 1 millón de tokens de salida
El precio introductorio estará vigente hasta el 31 de diciembre de 2026. Google indica que el precio estándar será de 1,50 $ por la entrada y 7,50 $ por la salida a partir del 1 de enero de 2027.
Gemini 3.5 Flash mantiene el precio de 1,50 $ por la entrada y 9,00 $ por la salida.
Las tarifas actuales para contextos cortos son:
Grok 4.6 2,00 $ de entrada / 0,50 $ en caché / 6,00 $ de salida
Grok 4.3 1,25 $ de entrada / 0,20 $ en caché / 2,50 $ de salida
xAI cobra más por contextos muy largos en Grok 4.6 y modelos relacionados, por lo que los equipos que utilicen cientos de miles de tokens por solicitud deben calcular por separado los precios para contextos largos.
El mercado chino combina aplicaciones gratuitas para consumidores, suscripciones de oficina, planes de agentes y suscripciones de programación.
El artículo original agrupa los principales productos de la siguiente manera.
| Producto | Instantánea de la fuente | Modelo principal o posicionamiento actual | Modelos de terceros |
|---|---|---|---|
| Kimi | Gratis más niveles de 49, 99, 199 y 699 ¥ | Familia Kimi K3 y Kimi Work | Principalmente modelos de Kimi |
| Productos de oficina Qwen | Gratis más niveles de oficina de pago | Familia Qwen3.8 | Algunos productos ofrecen modelos de terceros |
| Doubao | Gratis más niveles de 68, 200 y 500 ¥ en la instantánea de la fuente | Familia Doubao Seed 2.1 | DeepSeek disponible en determinados flujos de agentes |
| Zhipu Qingyan | Gratis más opciones de suscripción continua de pago | Familia GLM-5.3 | Principalmente modelos GLM |
| Plan de tokens de MiniMax | 49, 119 y 469 ¥ | Familias MiniMax M3 y M2.x | Principalmente modelos de MiniMax |
| DeepSeek | Web y aplicación gratuitas | DeepSeek V4.1 Flash / V4 Pro | No ofrece un selector general de terceros |
| Tencent Yuanbao | Gratis | Hunyuan + DeepSeek | DeepSeek disponible junto con Hunyuan |
La distinción clave para la compra es sencilla:
Dado que los precios de las aplicaciones para consumidores cambian por promociones, facturación de la App Store, región y elegibilidad de la cuenta, es más seguro tratar los importes de suscripción del artículo original como una instantánea de septiembre de 2026 y no como una lista de precios permanente.
La facturación de API es más fácil de comparar porque la unidad está estandarizada.
La tabla siguiente mantiene la estructura original, pero la corrige allí donde han cambiado las páginas oficiales actuales.
| Proveedor | Modelo | Entrada | Salida | Entrada en caché |
|---|---|---|---|---|
| DeepSeek | deepseek-flash / V4.1 Flash, fuera de hora punta | 1 ¥ | 4 ¥ | 0,02 ¥ |
| DeepSeek | deepseek-flash / V4.1 Flash, hora punta | 2 ¥ | 8 ¥ | 0,04 ¥ |
| DeepSeek | deepseek-v4-pro, fuera de hora punta | 4,5 ¥ | 13,5 ¥ | 0,15 ¥ |
| DeepSeek | deepseek-v4-pro, hora punta | 9 ¥ | 27 ¥ | 0,30 ¥ |
| Alibaba Qwen | qwen3.8-flash | 0,8 ¥ | 2,7 ¥ | 0,1 ¥ |
| Alibaba Qwen | qwen3.8-max | 12 ¥ | 36 ¥ | 1,5 ¥ |
| Alibaba Qwen | qwen3.7-flash, 0–32 K | 0,2 ¥ | 0,8 ¥ | 0,04 ¥ |
| Kimi | Kimi K3 | 20 ¥ | 100 ¥ | 2 ¥ |
| ByteDance | Doubao Seed 2.1 Pro | 6 ¥ | 30 ¥ | 1,2 ¥ en los precios del proveedor citado |
| Tencent | Hy4 preview | 6 ¥ | 18 ¥ | 0,3 ¥ |
| Zhipu | GLM-5.3 | aproximadamente 8–10 ¥ según la plataforma o el canal | aproximadamente 28–32 ¥ | Depende de la plataforma |
| Zhipu | GLM-5.3 Flash | aproximadamente 0,8–1,1 ¥ | aproximadamente 2,8–3,6 ¥ | Depende de la plataforma |
| MiniMax | MiniMax-M3, hasta 512 K de entrada | 2,1 ¥ | 8,4 ¥ | 0,42 ¥ en Tencent TokenHub |
DeepSeek V4.1 Flash es ahora el modelo que se encuentra detrás de deepseek-flash.
Los precios oficiales actuales son:
Fuera de hora punta:
acierto de caché 0,02 ¥ por 1 millón de tokens de entrada
fallo de caché 1,00 ¥ por 1 millón de tokens de entrada
salida 4,00 ¥ por 1 millón de tokens
Hora punta:
acierto de caché 0,04 ¥ por 1 millón de tokens de entrada
fallo de caché 2,00 ¥ por 1 millón de tokens de entrada
salida 8,00 ¥ por 1 millón de tokens
Las franjas actuales de hora punta de DeepSeek son de lunes a viernes, de 09:00 a 12:00 y de 14:00 a 18:00, hora de Pekín. El resto de periodos utiliza la tarifa fuera de hora punta.
La documentación oficial también indica que los nombres de modelos antiguos V4 Flash y V4 Flash Vision Exp ahora se dirigen a V4.1 Flash.
Actualmente, Qwen3.8-Max cuesta:
12 ¥ por 1 millón de tokens de entrada
1,5 ¥ por 1 millón de tokens de entrada en caché
36 ¥ por 1 millón de tokens de salida
Actualmente, Qwen3.8-Flash cuesta:
0,8 ¥ por 1 millón de tokens de entrada
0,1 ¥ por 1 millón de tokens de entrada en caché
2,7 ¥ por 1 millón de tokens de salida
Qwen3.7-Flash utiliza precios escalonados según la longitud de entrada, lo que significa que una única cifra de precio de entrada puede resultar engañosa para contextos grandes.
Describe tu idea una vez y We0 AI puede generar un sitio de presentacion, paginas y CMS, y ayudarte a atraer clientes y trafico tras el lanzamiento.
Una generación completa de proyectos para registro gratuito
Lo mejor para probar un flujo de generación completo y ver rápidamente el primer borrador del proyecto.
Tencent Cloud TokenHub muestra actualmente varios modelos uno al lado del otro, entre ellos:
Hy4 preview 6 ¥ de entrada / 18 ¥ de salida / 0,3 ¥ en caché
DeepSeek V4.1 1–2 ¥ de entrada / 4–8 ¥ de salida / 0,02–0,04 ¥ en caché
GLM-5.3 ~10,08 ¥ de entrada / ~31,67 ¥ de salida
Kimi K3 ~21,97 ¥ de entrada / ~109,87 ¥ de salida
MiniMax-M3 2,1 ¥ de entrada / 8,4 ¥ de salida para <=512 K de entrada
Esto resulta útil para comparar, pero no siempre es idéntico a los precios directos de primera parte. Un equipo de compras debe decidir si quiere contratos de primera parte, un marketplace en la nube o una pasarela multimodelo antes de comparar tarifas.
Los planes de programación son atractivos porque pueden proporcionar mucho más uso que la facturación de API convencional para una persona que trabaja de forma interactiva.
La limitación es igual de importante: la cuota suele estar vinculada a productos de programación o herramientas de agentes compatibles.
La instantánea de septiembre del artículo original incluye:
| Plataforma | Precios de la instantánea de la fuente | Estructura habitual de la cuota | Restricciones |
|---|---|---|---|
| Plan de tokens de Alibaba Model Studio | Lite 39 ¥ / Standard 139 ¥ / Pro 499 ¥ | Créditos semanales | Concurrencia de agentes según el nivel |
| Plan de programación GLM de Zhipu | Lite 118 ¥ / Pro 538 ¥ / Max 1.078 ¥ | Ventanas semanales y de cinco horas | Restricciones de claves API y plazas |
| Plan de tokens de Baidu Qianfan | Mini / Lite / Pro / Max | Bolsas mensuales de tokens | Reglas específicas del producto |
| Plan de tokens de Tencent Cloud | Hy Lite 28 ¥ / Standard 78 ¥ / Pro 238 ¥ / Max 468 ¥ | Créditos durante el mes de suscripción | Restricciones de claves del plan personal |
| Plan de tokens de MiniMax | 49 ¥ / 119 ¥ / 469 ¥ | Cuota orientada a agentes | Límites de agentes simultáneos |
| Kimi Code | Incluido con la membresía Kimi elegible en la instantánea de la fuente | Límites compartidos y semanales | Vinculado a la membresía |
| ByteDance Trae | Desde gratis hasta los niveles Ultra | Créditos mensuales | Concurrencia de tareas en la nube según el nivel |
| Tencent CodeBuddy | Desde gratis hasta los niveles superiores | Créditos mensuales | Créditos compartidos con productos relacionados |
Las cifras exactas y los descuentos promocionales pueden cambiar rápidamente, por lo que los planes de programación deben comprobarse inmediatamente antes de la compra.
Esta es la advertencia de compra más importante del artículo original.
Una suscripción de programación suele estar diseñada para:
Normalmente no está diseñada para:
Intentar utilizar un plan personal de programación como sustituto de una API de producción es el punto en el que suelen aparecer restricciones de cuenta, límites de velocidad y problemas de licencia.
La forma más sencilla de evitar errores de compra es decidir a qué registro pertenece la carga de trabajo antes de comparar precios.
El artículo original dedica una sección promocional a NoneLinear, una plataforma nacional de agregación que convierte los precios de modelos extranjeros a renminbi y expone los protocolos de varios proveedores a través de una única pasarela.
La categoría práctica merece analizarse aunque no utilices ese proveedor concreto.
Un agregador de modelos puede reducir la fricción operativa mediante:
Pero el precio efectivo no es lo único que debe revisarse.
Antes de utilizar cualquier agregador, confirma:
El artículo original afirma que el agregador destacado es compatible con los protocolos de OpenAI, Anthropic y Gemini, y que ofrece contabilidad de tokens por solicitud. Son funciones útiles, pero los equipos de compras deben verificar directamente el contrato y las condiciones de seguridad actuales del proveedor, en lugar de interpretar el artículo como una recomendación.
Un precio bajo por token es irrelevante si el servicio no puede comprarse, facturarse, integrarse u operarse de acuerdo con las normas de cumplimiento de la empresa.
El artículo original destaca cuatro dimensiones adicionales de la compra.
Muchas plataformas chinas de modelos de primera parte exigen verificación con nombre real o verificación empresarial antes de que estén disponibles las claves API, las recargas o determinados modelos.
La verificación personal y la facturación empresarial no siempre son intercambiables.
Una empresa que necesite una factura corporativa debe confirmar si la cuenta debe convertirse en una entidad empresarial antes de comenzar a utilizar el servicio.
Comprueba si el proveedor admite:
Un modelo más barato con una concurrencia baja puede resultar operacionalmente más caro que un modelo con un precio superior que cumpla los requisitos de latencia y rendimiento de la aplicación.
Para cargas de trabajo de producción, comprueba siempre:
| Tu situación | Modelo de facturación inicial recomendado | Tres aspectos que debes comprobar primero |
|---|---|---|
| Chat diario, documentos e investigación | Suscripción a una aplicación | Si el plan gratuito es suficiente; si las funciones de pago coinciden con las tareas recurrentes; condiciones de cancelación |
| Desarrollador individual con un uso moderado de programación | Plan de programación o tokens | Límites de cinco horas y semanales; concurrencia de agentes; si el uso está restringido a herramientas aprobadas |
| Integración de producto con usuarios reales | API de pago por consumo | Precio de salida; economía de los aciertos de caché; límites de velocidad y concurrencia |
| Necesidad de utilizar modelos extranjeros desde China continental | Facturación internacional de primera parte o agregador conforme | Sincronización de precios; conversión de divisas; facturación por solicitud y condiciones de datos |
| Cargas de trabajo de agentes de gran volumen | API más optimización de caché | Precio de la entrada en caché; longitud del contexto; uso de tokens de salida |
| Compra empresarial | Contrato empresarial directo o marketplace en la nube aprobado | SLA, facturación, condiciones de procesamiento de datos y soporte |
La regla de compra es sencilla:
Elige primero el modelo de facturación y después compara los precios dentro de ese modelo.
Si mezclas suscripciones para consumidores, cuotas de programación y API de producción en una sola clasificación, la cifra más barata suele carecer de sentido.
Para un uso personal ocasional, un plan gratuito para consumidores suele ser la opción más barata. Para una integración de producción, la opción más económica depende de la longitud de entrada, la longitud de salida, la tasa de aciertos de caché, la concurrencia y la capacidad del modelo para completar la tarea sin reintentos.
No. ChatGPT Plus es una suscripción para consumidores, mientras que el uso de la API de OpenAI se factura por separado. La misma separación general se aplica a la mayoría de los proveedores de IA.
A menudo puede serlo para un desarrollador que utilice intensivamente las herramientas de programación compatibles. Sin embargo, los planes de programación suelen tener ventanas de tiempo, límites de concurrencia, bolsas de créditos y restricciones que los hacen inadecuados para un servicio de producción orientado al cliente.
Los agentes de larga duración vuelven a enviar repetidamente las indicaciones del sistema, las instrucciones, el contexto del repositorio y el estado de conversaciones anteriores. Si gran parte de ese contexto puede almacenarse en caché, el precio de la entrada en caché puede convertirse en uno de los principales factores del coste total.
DeepSeek utiliza precios basados en franjas horarias para V4.1 Flash y V4 Pro. Las cargas de trabajo por lotes o sin conexión pueden ahorrar dinero si se ejecutan fuera de las franjas definidas de hora punta.
Sí, hasta el 31 de diciembre de 2026. Google indica que se trata de un precio introductorio y que el precio estándar está previsto que aumente a 1,50 $ por la entrada y 7,50 $ por la salida por millón de tokens el 1 de enero de 2027.
Las suscripciones existentes de Pro de 200 $ continúan, pero OpenAI pausó temporalmente las nuevas altas y actualizaciones al nivel de 200 $ el 10 de septiembre de 2026. Pro de 100 $ sigue disponible.
Puede simplificar la facturación y el acceso a varios modelos, pero la decisión debe depender de la seguridad, las condiciones de conservación de datos, la facturación, el SLA, la transparencia del enrutamiento y de si el proveedor repercute correctamente los precios y el comportamiento de los modelos de primera parte.
Las comparaciones de precios de IA solo resultan útiles después de separar tres productos distintos: suscripciones para consumidores, planes de programación o tokens y API de producción. Una suscripción de aplicación de 20 $, un plan de programación de 139 ¥ y una API facturada por tokens resuelven problemas de compra diferentes.
En las API, los tokens de salida y la entrada en caché suelen importar más que el precio principal de entrada. En los planes de programación, importan las ventanas de cuota y las restricciones de las herramientas. En la compra empresarial, la entidad de facturación, la compatibilidad con facturas, la concurrencia, el SLA y las condiciones de datos pueden ser tan importantes como el coste de los tokens.
La comparación original del 18 de septiembre es útil como orientación, pero varios precios y detalles de disponibilidad necesitan una verificación en tiempo real, especialmente las tarifas promocionales y la disponibilidad de las suscripciones para consumidores.
Elige primero el modelo de facturación correcto; solo entonces la pregunta «¿qué IA es más barata?» adquiere un significado real.
Empieza con una sola frase y obtén un sitio completo en minutos.