Um guia prático de preços de setembro de 2026 para os principais modelos e assinaturas de IA. Compare planos para consumidores, planos de pr...

Comparar preços de IA parece simples até que três modelos de cobrança completamente diferentes são colocados na mesma tabela.
O primeiro é a assinatura de aplicativo para consumidores. Você paga mensalmente por uma interface pronta para uso, com recursos como chat, pesquisa, manipulação de arquivos, pesquisa aprofundada, apresentações, memória e fluxos de trabalho com agentes.
O segundo é um Plano de programação ou tokens. Ele também costuma ser cobrado mensalmente, mas o valor compra uma cota ou um conjunto de créditos geralmente restrito às ferramentas oficiais de programação, aos produtos de agentes ou às integrações compatíveis de um fornecedor.
O terceiro é o uso de API com pagamento conforme o uso. Você paga pelos tokens de entrada e saída. Esse é o caminho normal quando o modelo precisa ser integrado ao seu próprio produto, aplicativo, back-end ou serviço voltado ao cliente.
Essas três “contas” podem custar dezenas ou centenas de dólares por mês, mas não são intercambiáveis.
Uma assinatura do ChatGPT não inclui o uso comum da API da OpenAI. Um plano de programação pode ser mais barato do que a cobrança por API para um desenvolvedor, mas inadequado para um serviço em produção. Uma API pode parecer cara por milhão de tokens, mas ser a única opção que oferece à empresa a simultaneidade, a observabilidade, o faturamento e o controle de integração necessários.
Este guia mantém a estrutura do artigo original e transforma os preços dispersos em uma referência mais adequada para decisões de compra.
Observação sobre preços: os preços mudam com frequência. Alguns planos são regionais, promocionais ou estão temporariamente indisponíveis. As tabelas abaixo refletem o retrato de preços de 18 a 20 de setembro de 2026 e foram comparadas com páginas oficiais de preços quando disponíveis.
As assinaturas para consumidores são a opção mais simples quando uma pessoa quer apenas usar o aplicativo oficial.
| Provedor | Plano gratuito | Plano inicial | Plano principal | Plano individual mais avançado |
|---|---|---|---|---|
| OpenAI ChatGPT | Gratuito | Go, US$ 8/mês nos EUA | Plus, US$ 20/mês | Pro, US$ 100; Pro, US$ 200 para assinantes existentes |
| Anthropic Claude | Gratuito | Pro, US$ 20/mês ou US$ 200/ano | Max 5x, US$ 100/mês | Max 20x, US$ 200/mês |
| Google Gemini | Gratuito | AI Plus, preço regional | AI Pro, US$ 19,99/mês nos EUA | AI Ultra, US$ 99,99/mês nos EUA |
| xAI Grok | Gratuito | — | SuperGrok, US$ 30/mês | SuperGrok Plus, US$ 100/mês |
| Perplexity | Gratuito | Planos educacionais ou com desconto quando elegível | Pro | Max |
Atualmente, a OpenAI oferece os níveis de consumidor Free, Go, Plus e Pro.
Nos Estados Unidos:
Há uma ressalva importante em setembro de 2026: a OpenAI suspendeu temporariamente novas inscrições e upgrades para o Pro de US$ 200 em 10 de setembro. Os assinantes existentes do Pro de US$ 200 não foram afetados, e o Pro de US$ 100 continua disponível.
Atualmente, usuários Free e Go usam o GPT-5.6 Luna na experiência padrão do ChatGPT, enquanto os planos pagos elegíveis podem acessar o GPT-5.6 Sol. O GPT-6 Pro, desenvolvido com o GPT-6 Astra, está disponível nos planos Pro, Business e Enterprise elegíveis.
Os preços individuais do Claude são diretos:
O Pro inclui Claude Code, Cowork, Design e acesso mais amplo aos modelos. Os planos Max aumentam principalmente os limites de uso e o acesso prioritário.
Os preços do Google AI variam conforme o mercado, mas a página de preços atual dos EUA lista:
O Google AI Plus existe como um nível inferior, mas o preço exibido pode variar por país e não é mostrado de forma consistente em todas as páginas regionais de preços.
Os planos incluem acesso ao Gemini, armazenamento do Google e outros serviços do Google. Por isso, não devem ser comparados como assinaturas baseadas exclusivamente em tokens.
A página atual de preços para consumidores da xAI lista:
Isso é diferente dos nomes e preços de planos antigos que ainda circulam on-line. Para decisões de compra, use a página de preços atual da xAI, e não uma tabela comparativa antiga.
Para integração de produtos, os preços de API são mais importantes do que as assinaturas para consumidores.
A tabela abaixo mostra as tarifas padrão para contextos curtos mais relevantes para a contratação comum de APIs.
| Provedor | Modelo | Entrada | Entrada em cache | Saída |
|---|---|---|---|---|
| OpenAI | GPT-6 Astra | US$ 10,00 | US$ 1,00 | US$ 50,00 |
| OpenAI | GPT-5.6 Sol | US$ 4,00 | US$ 0,40 | US$ 20,00 |
| OpenAI | GPT-5.6 Terra | US$ 2,00 | US$ 0,20 | US$ 12,00 |
| OpenAI | GPT-5.6 Luna | US$ 0,20 | US$ 0,02 | US$ 1,20 |
| Anthropic | Claude Fable 5.1 | US$ 10,00 | US$ 0,25 | US$ 50,00 |
| Anthropic | Claude Opus 5 | US$ 5,00 | US$ 0,50 | US$ 25,00 |
| Anthropic | Claude Sonnet 5 | US$ 2,00 | US$ 0,20 | US$ 10,00 |
| Anthropic | Claude Haiku 4.5 | US$ 1,00 | US$ 0,10 | US$ 5,00 |
| Gemini 3.5 Flash | US$ 1,50 | US$ 0,15 | US$ 9,00 | |
| Gemini 3.1 Pro Preview (entrada < 200K) | US$ 2,00 | — | US$ 12,00 | |
| Preço introdutório do Gemini 3.8 Flash | US$ 0,75 | US$ 0,075 | US$ 3,75 | |
| xAI | Grok 4.6 | US$ 2,00 | US$ 0,50 | US$ 6,00 |
| xAI | Grok 4.3 | US$ 1,25 | US$ 0,20 | US$ 2,50 |
A tabela da OpenAI no artigo original está, de modo geral, alinhada aos preços oficiais atuais.
As tarifas padrão atuais para contextos curtos são:
GPT-6 Astra US$ 10 entrada / US$ 50 saída
GPT-5.6 Sol US$ 4 entrada / US$ 20 saída
GPT-5.6 Terra US$ 2 entrada / US$ 12 saída
GPT-5.6 Luna US$ 0,20 entrada / US$ 1,20 saída
Esses preços são por 1 milhão de tokens.
A tarifa de US$ 4/US$ 20 do GPT-5.6 Sol é promocional e está disponível pelo menos até 21 de novembro de 2026. As solicitações com contexto longo também podem ter preços diferentes. Portanto, uma planilha de compras não deve presumir que todas as solicitações usam a tarifa para contexto curto.
Os preços atuais da Anthropic para uso próprio são:
Claude Fable 5.1 US$ 10 entrada / US$ 50 saída / US$ 0,25 acerto de cache
Claude Opus 5 US$ 5 entrada / US$ 25 saída / US$ 0,50 acerto de cache
Claude Sonnet 5 US$ 2 entrada / US$ 10 saída / US$ 0,20 acerto de cache
Claude Haiku 4.5 US$ 1 entrada / US$ 5 saída / US$ 0,10 acerto de cache
Uma correção útil em relação a tabelas comparativas antigas é que os acertos de cache do Fable 5.1 custam US$ 0,25 por milhão de tokens, e não US$ 1,00.
A Anthropic também oferece descontos para processamento em lote e preços separados para gravação em cache. Por isso, o custo efetivo de uma carga de trabalho de agente com contexto longo pode diferir significativamente dos valores anunciados de entrada e saída.
Atualmente, o Gemini 3.8 Flash custa:
US$ 0,75 / 1 milhão de tokens de entrada
US$ 0,075 / 1 milhão de tokens de entrada em cache
US$ 3,75 / 1 milhão de tokens de saída
O preço introdutório vigora até 31 de dezembro de 2026. O Google informa que o preço padrão passará a ser de US$ 1,50 para entrada e US$ 7,50 para saída em 1º de janeiro de 2027.
O Gemini 3.5 Flash continua custando US$ 1,50 para entrada e US$ 9,00 para saída.
As tarifas atuais para contexto curto são:
Grok 4.6 US$ 2,00 entrada / US$ 0,50 em cache / US$ 6,00 saída
Grok 4.3 US$ 1,25 entrada / US$ 0,20 em cache / US$ 2,50 saída
A xAI cobra mais por contextos muito longos no Grok 4.6 e em modelos relacionados. Por isso, equipes que usam centenas de milhares de tokens por solicitação devem calcular separadamente os preços para contextos longos.
O mercado chinês combina aplicativos gratuitos para consumidores, assinaturas de escritório, planos de agentes e assinaturas de programação.
O artigo original agrupa os principais produtos da seguinte forma.
| Produto | Retrato da fonte | Principal modelo ou posicionamento atual | Modelos de terceiros |
|---|---|---|---|
| Kimi | Gratuito, além dos níveis de ¥49 / ¥99 / ¥199 / ¥699 | Família Kimi K3 e Kimi Work | Principalmente modelos Kimi |
| Produtos de escritório Qwen | Gratuito, além de níveis pagos para escritório | Família Qwen3.8 | Alguns produtos disponibilizam modelos de terceiros |
| Doubao | Gratuito, além dos níveis de ¥68 / ¥200 / ¥500 no retrato da fonte | Família Doubao Seed 2.1 | DeepSeek disponível em fluxos selecionados de agentes |
| Zhipu Qingyan | Gratuito, além de opções de assinatura contínua paga | Família GLM-5.3 | Principalmente modelos GLM |
| MiniMax Token Plan | ¥49 / ¥119 / ¥469 | Famílias MiniMax M3 / M2.x | Principalmente modelos MiniMax |
| DeepSeek | Web e aplicativo gratuitos | DeepSeek V4.1 Flash / V4 Pro | Sem seletor geral de terceiros |
| Tencent Yuanbao | Gratuito | Hunyuan + DeepSeek | DeepSeek disponível ao lado do Hunyuan |
A principal distinção para a compra é simples:
Como os preços dos aplicativos para consumidores mudam conforme promoções, cobrança pela App Store, região e elegibilidade da conta, é mais seguro tratar os valores de assinatura do artigo original como um retrato de setembro de 2026, e não como uma tabela de preços permanente.
A cobrança por API é mais fácil de comparar porque a unidade é padronizada.
A tabela abaixo mantém a estrutura original, mas faz correções nos pontos em que as páginas oficiais atuais mudaram.
| Provedor | Modelo | Entrada | Saída | Entrada em cache |
|---|---|---|---|---|
| DeepSeek | deepseek-flash / V4.1 Flash, fora do horário de pico | ¥1 | ¥4 | ¥0,02 |
| DeepSeek | deepseek-flash / V4.1 Flash, horário de pico | ¥2 | ¥8 | ¥0,04 |
| DeepSeek | deepseek-v4-pro, fora do horário de pico | ¥4,5 | ¥13,5 | ¥0,15 |
| DeepSeek | deepseek-v4-pro, horário de pico | ¥9 | ¥27 | ¥0,30 |
| Alibaba Qwen | qwen3.8-flash | ¥0,8 | ¥2,7 | ¥0,1 |
| Alibaba Qwen | qwen3.8-max | ¥12 | ¥36 | ¥1,5 |
| Alibaba Qwen | qwen3.7-flash 0–32K | ¥0,2 | ¥0,8 | ¥0,04 |
| Kimi | Kimi K3 | ¥20 | ¥100 | ¥2 |
| ByteDance | Doubao Seed 2.1 Pro | ¥6 | ¥30 | ¥1,2 nos preços do provedor citado |
| Tencent | Hy4 preview | ¥6 | ¥18 | ¥0,3 |
| Zhipu | GLM-5.3 | aproximadamente ¥8–10, dependendo da plataforma ou do canal | aproximadamente ¥28–32 | depende da plataforma |
| Zhipu | GLM-5.3 Flash | aproximadamente ¥0,8–1,1 | aproximadamente ¥2,8–3,6 | depende da plataforma |
| MiniMax | MiniMax-M3, entrada de até 512K | ¥2,1 | ¥8,4 | ¥0,42 no Tencent TokenHub |
O DeepSeek V4.1 Flash é agora o modelo por trás de deepseek-flash.
Os preços oficiais atuais são:
Fora do horário de pico:
acerto de cache ¥0,02 / 1 milhão de tokens de entrada
erro de cache ¥1,00 / 1 milhão de tokens de entrada
saída ¥4,00 / 1 milhão de tokens
Horário de pico:
acerto de cache ¥0,04 / 1 milhão de tokens de entrada
erro de cache ¥2,00 / 1 milhão de tokens de entrada
saída ¥8,00 / 1 milhão de tokens
As janelas atuais de pico do DeepSeek são de segunda a sexta-feira, das 09:00 às 12:00 e das 14:00 às 18:00, no horário de Pequim. Os demais períodos usam a tarifa fora do horário de pico.
A documentação oficial também informa que os nomes de modelo antigos V4 Flash e V4 Flash Vision Exp agora direcionam para o V4.1 Flash.
Atualmente, o Qwen3.8-Max custa:
¥12 / 1 milhão de tokens de entrada
¥1,5 / 1 milhão de tokens de entrada em cache
¥36 / 1 milhão de tokens de saída
Atualmente, o Qwen3.8-Flash custa:
¥0,8 / 1 milhão de tokens de entrada
¥0,1 / 1 milhão de tokens de entrada em cache
¥2,7 / 1 milhão de tokens de saída
O Qwen3.7-Flash usa preços escalonados conforme o tamanho da entrada. Isso significa que uma única linha com o “preço de entrada” pode ser enganosa para contextos grandes.
Descreva sua ideia uma vez e o We0 AI pode gerar um site de apresentacao, paginas e CMS, alem de ajudar a atrair clientes e trafego apos o lancamento.
Uma geração completa de projetos para registro gratuito
Melhor para experimentar um fluxo de geração completo e ver rapidamente um primeiro rascunho do projeto.
Atualmente, o TokenHub da Tencent Cloud lista vários modelos lado a lado, incluindo:
Hy4 preview ¥6 entrada / ¥18 saída / ¥0,3 cache
DeepSeek V4.1 ¥1–2 entrada / ¥4–8 saída / ¥0,02–0,04 cache
GLM-5.3 aproximadamente ¥10,08 entrada / aproximadamente ¥31,67 saída
Kimi K3 aproximadamente ¥21,97 entrada / aproximadamente ¥109,87 saída
MiniMax-M3 ¥2,1 entrada / ¥8,4 saída para entrada <=512K
Isso é útil para comparação, mas nem sempre é idêntico aos preços diretos dos fornecedores originais. Antes de comparar tarifas, uma equipe de compras deve decidir se deseja contratos diretos com os fornecedores, um marketplace de nuvem ou um gateway para vários modelos.
Os planos de programação são atraentes porque podem oferecer muito mais uso do que a cobrança comum por API para uma pessoa trabalhando de forma interativa.
A limitação é igualmente importante: a cota geralmente está vinculada a produtos de programação ou ferramentas de agentes compatíveis.
O retrato de setembro do artigo original inclui:
| Plataforma | Preços no retrato da fonte | Estrutura típica da cota | Restrições |
|---|---|---|---|
| Alibaba Model Studio Token Plan | Lite ¥39 / Standard ¥139 / Pro ¥499 | Créditos semanais | Simultaneidade de agentes por nível |
| Zhipu GLM Coding Plan | Lite ¥118 / Pro ¥538 / Max ¥1.078 | Janelas semanais / de cinco horas | Restrições de chave de API e assento |
| Baidu Qianfan Token Plan | Mini / Lite / Pro / Max | Conjuntos mensais de tokens | Regras específicas do produto |
| Tencent Cloud Token Plan | Hy Lite ¥28 / Standard ¥78 / Pro ¥238 / Max ¥468 | Créditos do mês da assinatura | Restrições de chave para planos pessoais |
| MiniMax Token Plan | ¥49 / ¥119 / ¥469 | Cota orientada a agentes | Limites de agentes simultâneos |
| Kimi Code | Incluído na assinatura Kimi elegível no retrato da fonte | Limites compartilhados + semanais | Vinculado à assinatura |
| ByteDance Trae | Gratuito até os níveis Ultra | Créditos mensais | Simultaneidade de tarefas na nuvem por nível |
| Tencent CodeBuddy | Gratuito até os níveis principais | Créditos mensais | Créditos compartilhados com produtos relacionados |
Os valores exatos e os descontos promocionais podem mudar rapidamente. Portanto, os planos de programação devem ser verificados imediatamente antes da compra.
Este é o alerta de compras mais importante do artigo original.
Uma assinatura de programação geralmente é criada para:
Geralmente, ela não é criada para:
Tentar usar um plano pessoal de programação como substituto de uma API de produção é o ponto em que começam a surgir restrições de conta, limites de taxa e problemas de licenciamento.
A maneira mais simples de evitar erros de compra é decidir a qual “conta” a carga de trabalho pertence antes de comparar preços.
O artigo original dedica uma seção promocional à NoneLinear, uma plataforma doméstica de agregação que converte os preços de modelos estrangeiros para RMB e disponibiliza protocolos de vários fornecedores por meio de um único gateway.
A categoria prática merece ser discutida mesmo que você não use esse fornecedor específico.
Um agregador de modelos pode reduzir o atrito operacional ao oferecer:
Mas o preço efetivo não é o único ponto a verificar.
Antes de usar qualquer agregador, confirme:
O artigo original afirma que o agregador destacado é compatível com os protocolos da OpenAI, Anthropic e Gemini e oferece contabilização de tokens por solicitação. Esses são recursos úteis, mas as equipes de compras ainda devem verificar diretamente o contrato e os termos de segurança atuais do fornecedor, em vez de tratar o artigo como um endosso.
Um preço baixo por token é irrelevante se o serviço não puder ser comprado, faturado, integrado ou operado de acordo com as regras de conformidade da empresa.
O artigo original destaca quatro dimensões adicionais de compras.
Muitas plataformas chinesas de modelos de primeira parte exigem verificação com nome real ou verificação empresarial antes que chaves de API, recargas ou alguns modelos se tornem disponíveis.
A verificação pessoal e o faturamento empresarial nem sempre são intercambiáveis.
Uma empresa que precisa de uma fatura corporativa deve confirmar se a conta precisa ser convertida em uma entidade empresarial antes do início do uso.
Verifique se o fornecedor aceita:
Um modelo mais barato com baixa simultaneidade pode ser mais caro operacionalmente do que um modelo mais caro que atenda aos requisitos de latência e vazão do aplicativo.
Para cargas de trabalho de produção, verifique sempre:
| Sua situação | Modelo de cobrança inicial | Três pontos a verificar primeiro |
|---|---|---|
| Chat, documentos e pesquisa no dia a dia | Assinatura de aplicativo | Se o plano gratuito é suficiente; se os recursos pagos correspondem às tarefas recorrentes; termos de cancelamento |
| Desenvolvedor individual com uso moderado de programação | Plano de programação ou tokens | Limites de cinco horas e semanais; simultaneidade de agentes; se o uso é restrito a ferramentas aprovadas |
| Integração de produto com usuários reais | API pré-paga | Preço da saída; economia dos acertos de cache; limites de taxa e simultaneidade |
| Necessidade de modelos estrangeiros na China continental | Faturamento internacional de primeira parte ou agregador em conformidade | Sincronização de preços; conversão de moeda; cobrança por solicitação e termos de dados |
| Cargas de trabalho de agentes em alto volume | API + otimização de cache | Preço da entrada em cache; tamanho do contexto; uso de tokens de saída |
| Compras empresariais | Contrato empresarial direto ou marketplace de nuvem aprovado | SLA, faturamento, termos de processamento de dados e suporte |
A regra de compra é direta:
Escolha primeiro o modelo de cobrança e depois compare os preços dentro desse modelo.
Se você misturar assinaturas para consumidores, cotas de programação e APIs de produção em um único ranking, o número mais baixo muitas vezes não terá significado.
Para uso pessoal ocasional, um plano gratuito para consumidores geralmente é o mais barato. Para integração em produção, a opção mais barata depende do tamanho da entrada, do tamanho da saída, da taxa de acerto de cache, da simultaneidade e da capacidade do modelo de concluir a tarefa sem novas tentativas.
Não. O ChatGPT Plus é uma assinatura para consumidores, enquanto o uso da API da OpenAI é cobrado separadamente. A mesma separação geral se aplica à maioria dos fornecedores de IA.
Isso pode acontecer para um desenvolvedor que usa intensivamente ferramentas de programação compatíveis. No entanto, os planos de programação geralmente têm janelas de uso, limites de simultaneidade, conjuntos de créditos e restrições que os tornam inadequados para um serviço de produção voltado ao cliente.
Agentes de longa duração reenviam repetidamente prompts de sistema, instruções, contexto de repositórios e o estado de conversas anteriores. Se grande parte desse contexto puder ser armazenada em cache, o preço da entrada em cache pode se tornar um dos maiores fatores do custo total.
O DeepSeek usa preços baseados no horário para o V4.1 Flash e o V4 Pro. Cargas de trabalho flexíveis em lote ou off-line podem economizar dinheiro ao serem executadas fora das janelas de pico definidas.
Sim, até 31 de dezembro de 2026. O Google informa que esse é um preço introdutório e que o preço padrão está programado para subir para US$ 1,50 para entrada e US$ 7,50 para saída por milhão de tokens em 1º de janeiro de 2027.
As assinaturas existentes do Pro de US$ 200 continuam ativas, mas a OpenAI suspendeu temporariamente novas inscrições e upgrades para o nível de US$ 200 em 10 de setembro de 2026. O Pro de US$ 100 continua disponível.
Ele pode simplificar o faturamento e o acesso a vários modelos, mas a decisão deve depender da segurança, dos termos de retenção de dados, do faturamento, do SLA, da transparência do roteamento e da capacidade de o fornecedor repassar com precisão os preços e o comportamento dos modelos de primeira parte.
As comparações de preços de IA só se tornam úteis depois que separam três produtos diferentes: assinaturas para consumidores, planos de programação/tokens e APIs de produção. Uma assinatura de aplicativo de US$ 20, um plano de programação de ¥139 e uma API cobrada por token resolvem problemas de compra diferentes.
Para APIs, os tokens de saída e a entrada em cache muitas vezes importam mais do que o preço anunciado da entrada. Para planos de programação, as janelas de cota e as restrições de ferramentas são importantes. Para compras empresariais, a entidade de faturamento, o suporte a faturas, a simultaneidade, o SLA e os termos de dados podem ser tão importantes quanto o custo dos tokens.
A comparação original de 18 de setembro é útil como orientação, mas vários preços e detalhes de disponibilidade precisam ser verificados em tempo real, especialmente as tarifas promocionais e a disponibilidade das assinaturas para consumidores.
Escolha primeiro o modelo de cobrança correto; só então a pergunta “qual IA é mais barata?” se torna significativa.
Comece com uma frase e tenha um site completo em minutos.