Claude: preço da API e quanto custa rodar seu app (2026)
Veja quanto custa a API do Claude por modelo, token, cache e ferramentas. Compare três orçamentos de apps e quando o Pro ou o Max compensa no uso pessoal.

Claude: preço da API parte de $1 por milhão de tokens de entrada e $5 por milhão de tokens de saída no Claude Haiku 4.5, o mais barato dos quatro modelos mais recentes da Anthropic. Comece por ele em tarefas bem delimitadas, passe para o Claude Sonnet 5.5 quando a qualidade exigir e reserve o Claude Opus 5.5 ou o Claude Fable 5.1 para falhas que justifiquem o custo adicional. Uma assinatura Pro ou Max pode sair mais barata no uso pessoal, mas não substitui a cobrança da API do seu app.
Preços conferidos na página de preços da Anthropic e na documentação de preços da Claude Platform em 4 de outubro de 2026. Todos os valores abaixo estão em dólares americanos. Os três orçamentos são exemplos calculados com premissas explícitas, não resultados medidos em produção nem afirmações de que todos os modelos entregam respostas de qualidade equivalente.
Claude: preço da API nos modelos atuais
O Haiku é o mais barato dos quatro modelos mais recentes; o Sonnet é o próximo passo quando o Haiku não passa na sua avaliação de qualidade. MTok significa um milhão de tokens, os fragmentos de texto que o modelo processa. Entrada é o que você envia; saída é o que ele gera.
A tabela reúne os modelos mais recentes e todos os modelos de gerações anteriores exibidos na página pública de preços. Em cada célula de cache, os valores seguem a ordem leitura / gravação com validade de cinco minutos. Todas as tarifas são por MTok e foram conferidas em outubro de 2026.
Fonte: tabela pública de preços dos modelos Claude. A documentação detalhada também inclui outros modelos e versões históricas. Ter um preço listado, por si só, não é motivo suficiente para escolher um modelo antigo para um app novo.

A comparação com gerações anteriores importa para quem já tem uma integração. O Opus 5.5 custa 20% menos que o Opus 5 com as mesmas quantidades de tokens de entrada sem cache e de saída, enquanto o Sonnet 5.5 mantém os preços do Sonnet 5. O Fable 5.1 preserva as tarifas de entrada e saída do Fable 5, mas reduz a leitura de cache de $1 para $0.25. São comparações de tarifas: se o agente passar a consumir mais tokens, a conta não necessariamente será menor. Tarifas oficiais.
Preço por token na API do Claude: conte cada categoria uma só vez
A conta depende de quais tokens são de entrada sem cache, gravados no cache, lidos do cache ou gerados na saída. O cache guarda conteúdo do prompt para reutilização, evitando que o mesmo material seja processado como entrada nova a cada chamada.
O que entra na cobrança da API da Anthropic?
Para calcular a conta de tokens, some estas quatro parcelas:
- Tokens de entrada sem cache divididos por um milhão, multiplicados pela tarifa de entrada.
- Tokens gravados no cache divididos por um milhão, multiplicados pela tarifa de gravação correspondente.
- Tokens lidos do cache divididos por um milhão, multiplicados pela tarifa de leitura.
- Tokens de saída divididos por um milhão, multiplicados pela tarifa de saída.
Depois, acrescente as cobranças de ferramentas e de tempo de execução que se aplicarem. Mantenha as categorias separadas: um token lido do cache não conta também como entrada sem cache. Inclua o histórico da conversa, as definições de ferramentas e os resultados das ferramentas que o modelo processa, em vez de orçar apenas a última frase do usuário. A Anthropic documenta essas categorias de cobrança e o consumo adicional das ferramentas.
A saída merece um orçamento próprio. No Sonnet 5.5, a tarifa de $10 para saída é cinco vezes a de $2 para entrada sem cache. Se o produto precisa de uma decisão curta, pedir um texto longo aumenta o custo sem melhorar o resultado necessário. Colocar o prompt em cache não dá desconto na resposta gerada.
A validade do cache muda o preço da gravação
A leitura barata vem depois de uma gravação paga. Gravar com validade de cinco minutos custa 1.25 vezes o preço de entrada sem cache do modelo; com validade de uma hora, custa o dobro. As tarifas de gravação por uma hora são Haiku $2, Sonnet $4, Opus $8 e Fable $20 por MTok. As leituras mantêm os valores da tabela. Preços de cache.
Para um prefixo reutilizável de um MTok no Sonnet, dois usos sem cache custam $4. Uma gravação com validade de cinco minutos seguida de uma leitura custa $2.50 + $0.20 = $2.70. O custo adicional da gravação se paga na primeira reutilização. Com cache de uma hora, uma gravação e duas leituras custam $4 + $0.40 = $4.40, contra $6 para três usos sem cache.
Escolha uma validade que seu padrão de chamadas consiga aproveitar. Um prompt fixo de regras, repetido em um serviço com muitas chamadas, é um bom candidato. Instruções que mudam com frequência ou chamadas esporádicas exigem mais gravações. Por isso, um orçamento que trata toda requisição como leitura barata estará errado.
Qual é o modelo Claude mais barato que resolve sua tarefa?
Escolha o modelo de menor custo que atende a um critério de qualidade definido para a tarefa. Compare classificações corretas, respostas aceitas ou trabalhos concluídos. Uma tarifa menor por token só ajuda se o resultado continuar útil.
Preço da API do Claude Haiku: comece com tarefas bem delimitadas
O Claude Haiku 4.5 é o mais barato entre os modelos mais recentes, a $1 de entrada/$5 de saída por MTok. Comece avaliando seu desempenho ao encaminhar chamados, extrair alguns campos ou classificar textos em um conjunto fixo de categorias. A Anthropic o apresenta como seu modelo econômico mais rápido. Preços dos modelos.
O limite é o seu critério de aceitação. Um classificador barato que encaminha tarefas repetidamente para a fila errada pode gerar mais custo de correção do que economiza em tokens. Se sua avaliação já mostra esse problema, não adote o Haiku como padrão.
Preço da API do Claude Sonnet: pague mais quando o resultado melhorar
O Claude Sonnet 5.5 custa $2/$10, o dobro das tarifas do Haiku para entrada sem cache e saída. É o próximo candidato para programação, respostas a clientes que exigem discernimento ou agentes que fazem mais do que uma classificação bem delimitada. A Anthropic o posiciona como um equilíbrio entre velocidade e inteligência; essa descrição serve de hipótese inicial para a sua avaliação. Posicionamento e tarifas oficiais.
Com as mesmas quantidades de tokens de entrada sem cache e de saída, o Sonnet precisa justificar a conta maior com resultados melhores. Concentre a avaliação nos erros que afetam seu negócio, em vez de trocar de modelo só porque a resposta parece mais elaborada.
Preço da API do Claude Opus: reserve o custo extra para casos difíceis
O Claude Opus 5.5 custa $4/$20, enquanto o Claude Fable 5.1 custa $10/$50. A Anthropic posiciona o Opus para programação prolongada e trabalho com conhecimento, e o Fable para raciocínio exigente e agentes que operam por períodos longos. Nenhum deles é uma escolha econômica como padrão para uma tarefa que o Haiku ou o Sonnet já conclui de forma aceitável. Tarifas atuais dos modelos.
Com quantidades idênticas de tokens de entrada sem cache e de saída, as contas de Haiku, Sonnet, Opus e Fable seguem a proporção 1:2:4:10. O uso de cache pode mudar essa relação. Exija evidências de que o modelo mais caro reduz falhas ou correções humanas o suficiente para compensar a diferença.

Como calcular o custo da API do Claude: três cenários
Calcule o custo da carga de trabalho antes de escolher o modelo. Estes exemplos mantêm as quantidades de tokens constantes para deixar a diferença de preço visível. Sua estimativa de produção deve usar o consumo real de cada modelo, incluindo novas tentativas. Os totais não incluem impostos, a infraestrutura do seu app nem cobranças de execução de código avulsa.
1. Classificador de chamados de um fundador: $150 ou $75 no Haiku
Considere 100,000 classificações por mês, cada uma com 1,000 tokens de entrada sem cache e 100 tokens de saída. Este exemplo não usa cache, busca nem ambiente de execução de agentes.
O consumo mensal é de 100 milhões de tokens de entrada e 10 milhões de tokens de saída. No Haiku, o cálculo fica assim:
100 × $1 + 10 × $5 = $150 por mês, ou $1.50 por 1,000 decisões.
Com o mesmo consumo, o Sonnet custa $300, o Opus $600 e o Fable $1,500. Se as decisões puderem esperar pelo processamento assíncrono em lote, o desconto de 50% em tokens reduz esses totais para $75, $150, $300 e $750, respectivamente. No Haiku em lote, o custo fica em $0.75 por 1,000 decisões. Tarifas e desconto por processamento em lote.
Para um fundador que organiza uma fila acumulada durante a noite, vale avaliar primeiro o Haiku em lote. Em uma interação ao vivo com o cliente, os requisitos de latência podem inviabilizar essa opção. Passar para o Sonnet dobra a conta padrão de tokens neste caso; pague essa diferença quando a qualidade da classificação exigir.
2. Assistente de políticas internas de um CTO: $134.60 no Sonnet com cache
Considere 10,000 respostas por mês. Cada uma usa um prefixo fixo de políticas com 20,000 tokens, 2,000 tokens de entrada sem cache e 500 tokens de saída.
Para contabilizar a criação do cache sem omitir custos, divida as chamadas em 100 ciclos de cache separados, com 100 requisições cada. Cada grupo termina dentro da validade de cinco minutos. Em cada grupo, há uma gravação paga do prefixo e 99 leituras.
Isso resulta em 2 milhões de tokens gravados no cache, 198 milhões de tokens lidos do cache, 20 milhões de tokens de entrada sem cache e 5 milhões de tokens de saída. Com as tarifas do Sonnet:
- Entrada sem cache: 20 × $2 = $40.
- Gravações no cache: 2 × $2.50 = $5.
- Leituras do cache: 198 × $0.20 = $39.60.
- Saída: 5 × $10 = $50.
Total: $134.60 por mês, ou $13.46 por 1,000 respostas. Sem cache, 220 milhões de tokens de entrada sem cache mais a mesma saída custam $490. Nessas condições, o cache economiza $355.40. Tarifas oficiais de cache e tokens.

A mesma carga de trabalho com cache custa $67.30 no Haiku, $229.60 no Opus ou $524.50 no Fable. Sonnet e Opus cobram exatamente $39.60 pelas leituras do cache, porque ambos têm tarifa de leitura de $0.20. O restante do custo adicional do Opus vem da entrada sem cache, das gravações e da saída.
Isso muda a decisão do CTO: o Opus acrescenta $95 a esse orçamento do Sonnet, em vez de dobrar a conta inteira. Só troque se as respostas aceitas justificarem a diferença. Se as requisições forem mais espaçadas ou a política mudar, aumente a quantidade de gravações antes de usar esta estimativa.
3. Agente gerenciado de um operador: $460 no Opus
Considere 1,000 sessões por mês, cada uma consumindo 50,000 tokens de entrada sem cache, 10,000 tokens de saída, 30 minutos de execução e duas buscas na web. A premissa de entrada inclui todo o histórico e conteúdo de ferramentas processados; o cache está desativado.
Com o Opus 5.5, o cálculo mensal é:
- Entrada: 50 milhões × $4 por milhão = $200.
- Saída: 10 milhões × $20 por milhão = $200.
- Tempo de execução ativo: 500 horas de sessão × $0.08 = $40.
- Busca: 2,000 buscas × $10 por 1,000 = $20.
Total: $460 por mês, ou $0.46 por sessão. Com as mesmas premissas, o custo é de $160 no Haiku, $260 no Sonnet ou $1,060 no Fable. São alternativas para avaliar, sem garantia de qualidade equivalente. Tarifas de Managed Agents e ferramentas.
Nas configurações que aceitam inferência somente nos EUA, o subtotal de tokens do Opus passa a ser $400 × 1.1; execução e busca continuam em $60. Total: $500. Já o modo rápido do Opus leva o total a $860. Combinando modo rápido e inferência somente nos EUA, o total chega a $940, calculado como $400 × 2 × 1.1 + $60.
Processamento em lote, inferência somente nos EUA e modo rápido
Use processamento em lote para tarefas que podem esperar; pague por região ou velocidade quando o app precisar. Cada opção altera uma parte diferente da decisão.
O processamento em lote economiza 50% na entrada e na saída. As tarifas do Sonnet em lote são $1/$5; as do Opus, $2/$10. O cache de prompts pode ser combinado com esse desconto. Sessões de Managed Agents não aceitam processamento em lote, então não dá para simplesmente dividir o terceiro orçamento pela metade. Preços de processamento em lote e sessões.
A inferência somente nos EUA custa 1.1 vezes a tarifa padrão de tokens nos modelos compatíveis. A documentação aplica o adicional à entrada sem cache, à saída, às gravações e às leituras do cache, não apenas à coluna de entrada sem cache. A opção vale para o Claude 4.6 e versões posteriores; não presuma que vale para o Haiku 4.5. O roteamento global usa as tarifas padrão. Preços por residência de dados.
O modo rápido do Opus 5.5 custa o dobro da tarifa padrão: $8 de entrada e $40 de saída por MTok. Ele pode ser combinado com cache e com a cobrança de inferência somente nos EUA quando compatível, mas não está disponível para processamento em lote. Use essa opção quando reduzir a espera melhorar o resultado para o usuário o suficiente para justificar o custo extra. Preços do modo rápido.
Dois detalhes de migração também afetam as estimativas. O Claude 4.6 e as versões posteriores oferecem a janela completa de contexto de um milhão de tokens com as tarifas padrão; portanto, um adicional antigo por contexto longo não deve entrar em um orçamento atual. A documentação também informa que o Claude 4.7 e versões posteriores usam um tokenizador que gera aproximadamente 30% mais tokens para o mesmo texto, com variação conforme o conteúdo. Meça suas requisições reais; não acrescente automaticamente essa estimativa aos exemplos acima. Notas sobre contexto e tokenizador.
Cobranças de ferramentas e franquia de execução de código
Uma mesma sessão de agente pode acumular vários tipos de cobrança. Estimar só os tokens é insuficiente quando o app também contrata execução hospedada ou buscas.
Claude Managed Agents custa $0.08 por hora de sessão ativa, além dos tokens. O tempo em execução é cobrado; períodos de inatividade, reagendamento e após o encerramento ficam de fora. Manter uma sessão aberta, portanto, é diferente de mantê-la em execução. Medição do tempo de execução.
A busca na web custa $10 por 1,000 buscas, além dos tokens usados para processar as requisições e o conteúdo encontrado. Cada busca conta uma vez, independentemente de quantos resultados retorna. A ferramenta de acesso a páginas, web fetch, não tem uma tarifa separada, mas o conteúdo recuperado continua consumindo tokens. Um agente de pesquisa que faz muitas buscas precisa prever tanto a quantidade de buscas quanto o volume de entrada que elas geram. Preços de busca e acesso a páginas.
A tabela pública de execução de código anuncia 50 horas gratuitas por dia para cada organização e, depois, $0.05 por hora adicional por contêiner. Essa é a informação atual em claude.com/pricing.
Os totais calculados acima não incluem execução de código avulsa. Quando souber quantas horas de contêiner são faturáveis, multiplique-as por $0.05. A documentação também informa que incluir arquivos pode gerar cobrança por tempo de execução mesmo sem chamar a ferramenta, porque os arquivos são pré-carregados no contêiner.
API do Claude ou assinatura: qual sai mais barata?
A assinatura pode compensar no uso pessoal coberto pelo plano; um app voltado a clientes continua precisando de orçamento próprio para a API. Claude Pro e Claude Max são planos para usar os produtos do Claude, incluindo o Claude Code, seu agente de programação. Eles não transformam a sua integração com a API em uma franquia incluída na assinatura.
Preço do Claude Pro e Max: pagamento mensal ou anual
O Pro custa $20 por mês ou $200 pagos antecipadamente por um ano. O Max começa em $100 por mês. A oferta anual do Pro exibe $17 por mês; dividindo o pagamento anual exato por doze, o valor é $16.67. O Max oferece opções com 5x ou 20x a capacidade do Pro, com cobrança mensal. Ofertas atuais dos planos.
Dez pagamentos de $20 equivalem ao preço anual de $200. O Pro anual passa a sair mais barato depois de dez meses pagos e economiza $40 em um ano completo. Para um projeto curto, a opção mensal evita pagar por meses sem uso. As condições publicadas de reembolso ao consumidor não tornam o pagamento anual um saldo mensal flexível.
A capacidade de uso continua sendo uma condição. Nos planos pessoais, o consumo depende do modelo, da extensão da conversa e dos recursos, com limites por sessão e por semana. A página de preços não promete uma quantidade fixa de tarefas. Planos pagos também podem usar créditos de uso cobrados pelas tarifas da API; esse consumo adicional medido precisa entrar na comparação.
Claude Code pela API: quando a assinatura começa a compensar?
Para trabalho pessoal de programação com os 50,000 tokens de entrada e 10,000 de saída no Opus do terceiro cenário, o custo da API só em tokens é de $0.40 por tarefa. Esta comparação exclui o tempo de execução de Managed Agents e as buscas, que são serviços separados da API.
Com esse perfil de consumo, 50 tarefas equivalem à mensalidade de $20 do Pro; 250 tarefas equivalem ao preço inicial de $100 do Max. São pontos de equilíbrio calculados, não quantidades de tarefas prometidas pela assinatura. Acima deles, um plano só custa menos se cobrir o modelo e o trabalho de que você precisa e se sua franquia for suficiente. Abaixo deles, pagar pelo consumo pode sair mais barato no uso esporádico.
O Fable exige uma verificação à parte: na comparação de planos, o Pro identifica o acesso ao Fable como uso por créditos. Não presuma que pagar $20 pelo Pro inclui todos os tokens de Fable que seu fluxo pela API consumiria. Acesso aos modelos por plano.
Consulte O Claude é gratuito? para decidir sobre os planos de uso pessoal e Preços do Claude Code para comparar as assinaturas de programação. Mantenha a conta do app em produção separada da assinatura usada para desenvolvê-lo.
Acesso gratuito, ofertas para estudantes e reembolsos
O app Free e os créditos iniciais para testar a API são ofertas diferentes. Nenhuma delas é um plano permanente de API gratuita para produção.
A chave da API do Claude tem preço próprio?
A tabela lista cobranças por tokens e recursos, sem um preço separado pela chave em si. A documentação informa que novos usuários recebem uma pequena quantidade de créditos gratuitos de API, mas não publica um valor fixo nem uma franquia recorrente de tokens gratuitos. Preveja o pagamento pelo uso depois que os créditos de teste acabarem. Perguntas frequentes sobre preços da API.
O Claude Free custa $0 e permite conversas comuns, busca na web, criação de arquivos e execução de código dentro do app. A comparação exclui Claude Code, Opus e Fable do Free. Quem só precisa de ajuda ocasional no app, fica dentro da franquia e não depende de recursos pagos pode nunca precisar pagar. Esse não é o caso de um desenvolvedor que atende clientes por uma API. Comparação do plano Free.
Ofertas para estudantes e política de reembolso
A página pública de preços descreve uma oferta Education para instituições de ensino, destinada a estudantes, professores e funcionários e com créditos de API específicos. Nenhuma das páginas de preços publica um desconto individual fixo na API para estudantes. Não desconte um cupom estudantil presumido de uma estimativa de produção.
Nas assinaturas de uso pessoal, os pagamentos geralmente não são reembolsáveis, salvo quando os termos ou a legislação local determinam o contrário. As perguntas frequentes de preços descrevem uma solicitação pelo app dentro do prazo de desistência de 14 dias para clientes do EEE e do Reino Unido; reembolsos da App Store são tratados pela Apple. Política de reembolso publicada.
Essas regras para consumidores não estabelecem uma promessa de reembolso de créditos de API. As duas tabelas de preços também não informam um prazo de validade dos créditos pré-pagos da API. Confirme os termos da compra antes de carregar um saldo alto.
Perguntas frequentes
Quanto custa a assinatura do Claude Code em comparação com a API?
O Pro custa $20 por mês ou $200 por ano, pagos antecipadamente; o Max começa em $100 por mês. O uso da API é cobrado conforme o consumo. Com o custo de $0.40 em tokens do Opus no exemplo, 50 tarefas equivalem a $20, mas a assinatura só compensa se o acesso aos modelos e a franquia cobrirem seu trabalho pessoal. Preços dos planos.
Quanto custa a API do GPT?
A tabela da Anthropic não estabelece um preço para a API do GPT. Mantenha os preços dos fornecedores separados e compare a mesma carga de entrada, saída, cache e ferramentas antes de decidir; uma tarifa do Claude não é uma cotação do GPT.
Qual é o preço do Claude Opus?
O Claude Opus 5.5 custa $4 por milhão de tokens de entrada e $20 por milhão de tokens de saída. As leituras do cache custam $0.20 e as gravações com validade de cinco minutos, $5. O Opus 5, da geração anterior, custa $5/$25 para entrada e saída; portanto, as tarifas de entrada sem cache e saída do 5.5 são 20% menores. O Sonnet 5.5 mantém as tarifas do Sonnet 5, de $2/$10. Tarifas oficiais dos modelos.
A chave da API do Claude é gratuita?
A tabela não lista uma tarifa separada pela chave, mas as requisições geram consumo faturável. Eventuais créditos iniciais de teste são limitados, não um plano permanente de API gratuita. Preços da API.
Como conseguir uma chave gratuita da API do Claude Opus?
A documentação menciona uma pequena quantidade de créditos iniciais para testar a API, sem prometer um valor. Não há promessa de acesso gratuito recorrente à API do Opus, e o plano de $0 do app Claude exclui o Opus. Informação sobre créditos de teste, Acesso aos modelos no plano Free.
Como funciona a cobrança da API do Claude?
A documentação descreve cobrança pelo consumo real em dólares americanos. Some entrada sem cache, saída, gravações e leituras do cache com as tarifas do modelo escolhido e depois acrescente as cobranças de busca, tempo de execução ou execução de código que se aplicarem. Detalhes de cobrança.
Preciso pagar para usar a API do Claude?
Sim, pelo consumo que ultrapassar os créditos iniciais de teste, caso existam. O app Free não oferece uma franquia recorrente de API para produção. Perguntas frequentes sobre teste e cobrança da API.
Posso usar minha assinatura do Claude como API?
Uma assinatura Pro ou Max não substitui o acesso à API cobrado separadamente pelo consumo do seu app. A página de preços diferencia o uso incluído do Claude Code da opção de créditos de API pagos conforme o consumo. Planos e preços da API.
Quais são as principais diferenças entre a API do Claude e a assinatura Pro?
A API oferece acesso aos modelos cobrado pelo consumo para integrações e agentes. O Pro oferece acesso pessoal ao Claude e ao Claude Code dentro da franquia do plano, por $20 mensais ou $200 anuais. Escolha conforme o ambiente em que o trabalho é realizado e depois compare os custos do uso pessoal coberto. Preços oficiais.
Quanto custa o Claude para estudantes?
Estudantes podem usar o app Free de $0. A página de preços da Anthropic descreve uma oferta Education para instituições, com créditos de API, mas não publica um desconto individual fixo na API para estudantes. Preços para estudantes e Education.
O Claude oferece reembolso?
As perguntas frequentes de preços dos planos de uso pessoal informam que os pagamentos geralmente não são reembolsáveis, com exceções previstas nos termos ou na legislação local. Elas descrevem uma solicitação pelo app dentro do prazo de desistência de 14 dias no EEE e no Reino Unido. Essa regra para consumidores não estabelece uma promessa de reembolso de créditos de API. Política de reembolso.
Defina o orçamento do seu app nesta semana
Comece com uma tarefa representativa e um critério de aceitação. O número útil é o custo de um resultado aceito, incluindo tentativas que falham, em vez do preço de uma única resposta impressionante.
Meça a requisição completa
Conte a entrada que seu app realmente envia, incluindo histórico e ferramentas, e a saída. Registre leituras e gravações de cache separadamente e conte buscas e tempo ativo de execução hospedada quando se aplicarem.
Calcule o custo do modelo mais barato que atende ao critério
Avalie primeiro o Haiku para tarefas bem delimitadas e depois o Sonnet, se a qualidade ficar abaixo do necessário. Encaminhe os casos difíceis ao Opus ou ao Fable apenas quando a melhora justificar o gasto adicional.
Ajuste os recursos de cobrança à carga de trabalho
Coloque em cache o contexto que não muda, processe em lote o que puder esperar e deixe explícitos os adicionais por região ou velocidade. Para execução de código avulsa, esclareça a divergência de franquia antes de acrescentar uma estimativa de excedente.
Associe cada tarefa a uma ferramenta e a um orçamento adequados com o Mapa de ferramentas de IA para empresários.
- Última atualização
- 4 de out. de 2026
- Categoria
- AI







