economIA
Como comparar o custo de tokens de GPT, Claude e Gemini sem planilha
Publicado em 26 de agosto de 2026
A fatura da API de IA chega em dólar, com linha de entrada, linha de saída e um total difícil de explicar na reunião. Um modelo barato no site do provedor vira caro quando a equipe gera código o dia inteiro. Outro, com preço alto na tabela, sai mais em conta se o fluxo for quase só leitura de contexto. Sem o mesmo volume nas duas pontas, a escolha é por nome, não por conta.
A economIA é uma calculadora de custo de tokens. Você informa o consumo uma vez, marca o modelo que está usando e vê 33 modelos de 8 provedores lado a lado: OpenAI, Anthropic, Google, DeepSeek, xAI, Mistral, Moonshot AI e Z.ai. O ranking vai do mais econômico ao mais caro para aquele volume. A interface está em português, o resultado atualiza ao vivo e a moeda pode ser dólar ou real. Não há cadastro.
O que a calculadora pede e o que ela devolve
A configuração tem três passos: dados de consumo, modelo usado e moeda.
Há dois jeitos de informar o consumo. Entrada + saída, marcado como mais preciso, pede tokens de input e de output em campos separados. Só tenho o total serve quando a fatura só mostra um número agregado. Nesse modo a ferramenta estima a divisão: um controle pergunta quanto daquele total foi resposta da IA, de 5% a 60%, e resume a conta, por exemplo 80% entrada e 20% saída.
Se você não quer chutar o percentual, há três atalhos de perfil: Chat a 15% de saída, Código a 30% e Agentes a 40%. Isso não converte parágrafo em token. É um recorte operacional. Chat tende a ler mais do que gerar. Código e agente geram mais. Quem tem o dado real de input e output deve ficar no modo detalhado.
Os campos aceitam número completo ou atalho: 1.000.000, 267,4M, 900K ou 1.2B. O máximo por campo é 1 trilhão. Acima disso a ferramenta avisa que o cálculo perde precisão e pede para dividir por período ou projeto. Há volume total rápido em 100K, 1M, 10M e 100M.
O segundo passo é o modelo usado. O seletor agrupa por provedor e já mostra o preço público em dólar por 1 milhão de tokens, no formato entrada/saída. Na tabela verificada em 26/08/2026, Claude Fable 5 aparece a US$ 10/50, Claude Sonnet 5 a US$ 2/10, GPT-5 nano a US$ 0,05/0,4, Gemini 2.5 Flash-Lite a US$ 0,1/0,4 e DeepSeek V4-Flash a US$ 0,14/0,28. Esses valores mudam. A data no topo da página é o ponto de verificação, não uma garantia eterna.
O terceiro passo é a moeda. USD mostra o custo na unidade da tabela dos provedores. BRL aplica uma cotação USD para BRL, automática, com botão para atualizar, e aceita valor manual. Se a cotação automática falhar, a interface avisa e usa um valor padrão até você corrigir.
Ao lado do formulário fica o resumo: modelo escolhido, custo estimado, volume de entrada e de saída, e um bloco de maior economia possível contra o modelo mais barato da tabela. Há um exemplo pronto, o botão de 382 milhões de tokens, que preenche 267,4 milhões de entrada e 114,6 milhões de saída no DeepSeek V4-Flash.
Como a estimativa é feita
A metodologia está na própria página. A ferramenta multiplica seus tokens de entrada e de saída pelos preços públicos de cada provedor. A comparação mantém o mesmo volume em todos os modelos. Tokenizadores diferentes podem alterar o consumo real: um milhão de tokens no Claude não é, necessariamente, um milhão no GPT. A calculadora não tenta corrigir isso. Ela compara preço no volume que você informou.
Em linguagem de fatura, o custo de um modelo é o volume de entrada dividido por 1 milhão, vezes o preço de input, mais o volume de saída dividido por 1 milhão, vezes o preço de output. Não há conversão de palavra para token. Se você ainda não tem o número, precisa tirá-lo do painel do provedor ou do campo de usage da API. A economIA começa depois desse número existir.
Há um modo de cobrança extra: Padrão ou Batch API. O Batch aplica o desconto oficial de cerca de 50% só nos modelos cuja Batch API é documentada publicamente. Na tabela atual, isso vale para OpenAI, Anthropic e Google. DeepSeek, xAI, Mistral, Moonshot AI e Z.ai mantêm o preço padrão mesmo com o modo Batch ligado. A nota do resumo deixa isso explícito quando o modelo escolhido não publica o desconto.
O que a estimativa ainda não inclui, nas palavras da ferramenta: desconto de cache, desconto de volume e tarifas especiais para contexto longo. Vários modelos trazem observação no ranking, por exemplo cache hit da DeepSeek, da Kimi K3 ou da GLM, ou o aviso de que prompts acima de 200 mil tokens dobram o preço no Grok 4.5, no Grok 4.6 e no Gemini 3.1 Pro. A observação aparece. O desconto ou o aumento não entra na conta. Tráfego com prompt cacheado tende a ficar mais barato na fatura do que na tela. Contexto enorme com tarifa especial pode ficar mais caro.
Outras notas valem ler antes de trocar de provedor. Gemini 2.5 Flash-Lite aparece como aposentado em 16/10/2026. GPT-5.6 Sol tem preço promocional até novembro de 2026. Gemini 3.7 Flash avisa que o preço sobe em janeiro de 2027. Grok Build 0.1 está marcado como focado em coding. Nada disso é ranking de qualidade. É preço e ressalva. As fontes estão no rodapé, com link para as páginas oficiais dos oito provedores.
Ranking ao vivo e quando a comparação ajuda
Abaixo do formulário vem a comparação completa. O ranking lista os 33 modelos do mais barato ao mais caro. Dá para buscar por nome ou provedor e filtrar por um único fornecedor. Cada linha mostra posição, modelo, preço por 1 milhão (entrada / saída), custo estimado e a diferença contra o modelo marcado como atual.
Se o modelo é mais barato, a coluna diz quanto você economizaria e em que percentual. Se é mais caro, diz quanto custa a mais. O modelo escolhido ganha o selo "seu modelo". O primeiro do ranking ganha "menor custo". Com o volume padrão da tela, 1 milhão de entrada e 200 mil de saída, o ranking da verificação de 26/08/2026 colocou GPT-5 nano perto de US$ 0,13, DeepSeek V4-Flash perto de US$ 0,20 e Claude Fable 5 em US$ 20,00, com GPT-5.5 Pro no fim, perto de US$ 66,00. Troque o volume ou a fatia de saída e a ordem relativa pode mudar, porque output quase sempre custa várias vezes o input.
Use o ranking para decidir o que testar, não para trocar o modelo do produto no escuro. Um Flash-Lite barato pode classificar ticket. Pode ser péssimo para revisar um contrato. A calculadora responde quanto custa o mesmo volume. Qualidade, latência, limite de contexto e política de dados continuam fora da conta.
Um fluxo curto: copie tokens de entrada e de saída do painel do provedor, cole no modo detalhado (ou some os dois e use Chat, Código ou Agentes), selecione o modelo que realmente rodou esse volume e leia o resumo. Se a operação aguenta espera, ligue Batch API e veja quem de fato cai cerca de 50%. Se a fatura é em real, mude a moeda e confira a cotação antes de levar o número ao financeiro.
A economIA guarda preferências no navegador (moeda, modelo, tokens, modo de uso e de cobrança) e tem tema claro e escuro. Não substitui o extrato do provedor. Substitui a planilha em que você copia preço de oito sites e erra a célula do output.
A calculadora ajuda quando o custo já dói e a equipe discute troca de modelo no feeling, ou quando ninguém tem o mesmo volume nas tabelas do Gemini e do Claude. Não ajuda se você ainda não tem token nenhum: aí o trabalho é instrumentar a API. Também não projeta chamadas por dia nem estima tokens a partir de um texto colado.
Quem ocupa um estado no mapa do Os 27 está pedindo visita, não um post genérico sobre economia. O histórico mostra quem já pagou para aparecer. A economIA resolve uma conta específica: o mesmo volume de tokens, oito provedores, ranking ao vivo, em dólar ou real. Cole o consumo e discuta modelo com número na mesa.