Calculadora gratuita de custos de tokens de AI
Veja quantos tokens (e dólares) você desperdiça reexplicando o contexto a cada mensagem no ChatGPT ou Claude - individualmente ou como equipe - e quanto um arquivo de Skill carregado economizaria.
Seu desperdício mensal de tokens aparecerá aqui.
Preencha seus dados de uso e clique em Calcular.
O que é uma calculadora de custos de tokens de AI?
Uma calculadora de custos de tokens de AI estima quantos tokens - e quanto dinheiro - você gasta no ChatGPT, Claude ou qualquer chat de AI, com base na forma como você realmente o utiliza. Esta calculadora gratuita de custos de tokens de AI se concentra em uma fonte específica e muito comum de desperdício: colar novamente as mesmas instruções de função, formato ou voz da marca no chat a cada mensagem, em vez de carregá-las uma vez.
Insira quantas conversas você inicia por dia, quantas mensagens de acompanhamento cada uma tem e, aproximadamente, qual é o tamanho do contexto que você repete. A calculadora estima seus tokens desperdiçados por mês, quanto isso custa com preços típicos de APIs pagas e quanto desse desperdício desaparece quando o mesmo contexto passa a ficar em um arquivo de Skill persistente ou nas instruções do projeto, em vez de ficar na sua área de transferência. Mude para o modo equipe para ver os mesmos cálculos aplicados ao uso de AI de toda uma equipe - geralmente, o número é maior.
Medir o desperdício é o primeiro passo. Noor, o Skill de Engenharia de prompts no KissMySkills, transforma Claude, ChatGPT ou qualquer chat de AI em um engenheiro de prompts sênior que cria os prompts e arquivos de Skill reutilizáveis e prontos para produção que eliminam esse desperdício de vez - sem exigir experiência em engenharia de prompts.
Por que um token não é uma palavra
Todos os fornecedores publicam aproximadamente a mesma estimativa para o inglês: um token equivale a cerca de quatro caracteres, ou aproximadamente três quartos de uma palavra. O Google expressa isso como 100 tokens correspondendo aproximadamente a 60 a 80 palavras em inglês. A Anthropic fornece um número um pouco mais preciso, de cerca de 3,5 caracteres por token, e acrescenta a ressalva importante - a contagem exata varia conforme o idioma e o tipo de conteúdo.
Essa ressalva é maior do que parece. As contagens de tokens nem sequer são estáveis entre modelos do mesmo fornecedor: a Anthropic observa que seu tokenizador mais recente produz aproximadamente 30% mais tokens para o mesmo texto do que o anterior. Entrada idêntica, mesmo fornecedor, cobrança materialmente diferente.
Portanto, trate qualquer estimativa de tokens - inclusive esta - como uma ordem de grandeza. Se precisar do número real, conte em vez de estimar: todos os principais fornecedores oferecem um tokenizador ou um campo de uso na resposta da API que informa exatamente pelo que você foi cobrado.
A saída custa várias vezes mais do que a entrada
A coisa mais útil a saber sobre os preços dos tokens é que as duas direções não têm o mesmo preço. A entrada é o que você envia; a saída é o que o modelo gera; a saída é consistentemente a mais cara.
Verificado em agosto de 2026, os preços publicados pela Anthropic por milhão de tokens mantêm uma proporção exata de 5× em toda a linha - Opus 5 a US$ 5 de entrada contra US$ 25 de saída, Haiku 4.5 a US$ 1 contra US$ 5. O atual modelo principal da OpenAI fica em US$ 5 contra US$ 30, uma proporção de 6×, com seu nível mais barato a US$ 0,20 contra US$ 1,20. A linha Gemini do Google varia aproximadamente de 4× a 8×.
Os números exatos terão mudado quando você ler isto - consulte a página de preços do provedor. A proporção é a parte duradoura: nos três fornecedores, a saída custa cerca de quatro a oito vezes mais do que a entrada. Isso tem uma consequência prática. Encurtar um prompt do sistema exageradamente longo economiza tokens de entrada, que são os mais baratos. Pedir uma resposta mais curta economiza tokens de saída, que não são. Se o problema de custo for real, veja quanto o modelo está escrevendo antes de verificar quanto você está enviando.
Por que a décima interação custa mais do que a primeira
As APIs de chat são sem estado. A OpenAI explica isso claramente: cada solicitação de geração de texto é independente, e você cria uma conversa com várias interações enviando as mensagens anteriores de volta como parâmetros. A Anthropic descreve a mesma estrutura de cobrança - a entrada de cada interação contém todo o histórico anterior da conversa mais a mensagem atual, e tudo na solicitação é contabilizado, incluindo o prompt do sistema e as definições das suas ferramentas.
Portanto, uma conversa não custa a soma de suas mensagens. A décima rodada cobra novamente as rodadas de um a nove como entrada nova. Se cada rodada adicionar aproximadamente a mesma quantidade de texto, a entrada acumulada cobrada ao longo de uma conversa cresce com o quadrado do número de rodadas, e não linearmente. Essa aritmética é nossa, não uma afirmação de um fornecedor, mas decorre diretamente do modelo de reenvio documentado pelas duas empresas - e é por isso que uma conversa longa fica cara de uma maneira que surpreende as pessoas.
Dois mecanismos documentados ajudam a reduzir isso. O cache de prompts cobra um adicional para gravar uma entrada no cache e oferece um desconto significativo para lê-la: a Anthropic cobra 1,25× o preço-base de entrada para gravar um cache de cinco minutos e 0,1× para lê-lo, fazendo com que ele se pague após um único acesso. A OpenAI aplica o mesmo adicional de 1,25× na gravação e um desconto de 90% sobre a entrada armazenada em cache, exigindo um prefixo de pelo menos 1.024 tokens. Separadamente, os três fornecedores oferecem um desconto de 50% para processamento assíncrono em lote, e a Anthropic afirma que os descontos de cache e de processamento em lote são cumulativos.
O que esta calculadora não consegue fazer
Ele não estima sua cobrança total. Ele modela um modo de falha - contexto repetido - e não seu gasto total. Sua fatura real é dominada pela quantidade de texto que os modelos geram, algo que esta ferramenta não consegue ver.
O valor em dólares pode não ser o dinheiro que você realmente gasta. Isso é o mais importante e é fácil não perceber. ChatGPT Plus e Claude Pro são assinaturas de preço fixo, não cobradas por token. Se você trabalha dentro de uma assinatura de chat em vez de usar a API, o custo mostrado aqui é o valor equivalente na API do desperdício, não uma cobrança na sua fatura. Os tokens desperdiçados são reais de qualquer forma - eles consomem a janela de contexto e custam tempo, além de reduzirem o espaço para o trabalho de fato - mas apenas usuários da API os veem como um item na fatura.
Ele não conhece seus descontos. Cache, processamento em lote e tarifas negociadas podem alterar uma cobrança de API em uma ordem de grandeza, e nenhum deles está incluído neste modelo.
Os preços mudam. Cada valor nesta página traz a data em que foi verificado por um motivo. Os provedores alteram as tarifas, lançam novas categorias de modelos e, ocasionalmente, mudam o tokenizer subjacente. Verifique antes de tomar uma decisão de orçamento com base nele.