OpenAI API pricing: quanto custa um app com GPT-6.1 Sol?
Veja os preços da API OpenAI para GPT-6.1 Sol, Luna e Astra, com três orçamentos mensais de apps e custos de voz, imagens, buscas e contêineres em USD.

A tabela OpenAI API pricing faz do GPT-6.1 Sol um ponto de partida sensato para o agente de programação de uma equipe pequena: $2 por milhão de tokens de entrada, $0.10 de entrada em cache e $10 de saída. Nos orçamentos mensais ilustrativos abaixo, usar GPT-6 Luna no atendimento com escopo definido e nos resumos em lote, mantendo Sol na programação, custa $159.40 pelo uso de API especificado. Escolha GPT-6 Astra quando o trabalho que ele poupar justificar a conta mais alta.
Preços conferidos na página de preços da API da OpenAI em 3 de outubro de 2026. Todas as tarifas da empresa apresentadas abaixo vêm dessa página. Os volumes de trabalho são premissas declaradas, e os cálculos usam essas tarifas.
A API da OpenAI é a interface que seu aplicativo chama e que cobra conforme o uso. A conta depende do conteúdo enviado ao modelo, do que ele gera e das ferramentas pagas que o aplicativo aciona.

OpenAI API pricing: quanto custa cada modelo?
GPT-6.1 Sol custa $2 de entrada, $0.10 de entrada em cache e $10 de saída por milhão de tokens. A OpenAI o apresenta como opção para programação complexa e fluxos de trabalho com agentes. GPT-6 Luna é voltado a tarefas específicas em grande volume, enquanto GPT-6 Astra atende às tarefas mais difíceis, de ponta a ponta.
A tabela reúne todos os modelos em destaque na aba de preços da API consultada; não é um catálogo histórico. Nas linhas de tokens, os valores são em USD por 1M de tokens. As linhas de cobrança por tempo indicam minutos e segundos. Os preços dos três principais modelos de texto correspondem ao processamento Standard para contextos abaixo de 272K, ou seja, o volume de conteúdo incluído em uma solicitação. Essa condição delimita a faixa de preço, não o tamanho máximo de contexto dos modelos.
Fonte: preços da API da OpenAI, conferidos em outubro de 2026. “Não informado” significa que a fonte não apresenta aquela tarifa; não indica uma franquia gratuita de saída. “Sem separação” significa que o preço exibido é por tempo, sem valores distintos para entrada e saída de tokens.
GPT-6 Sol não aparece nas linhas de preços de API dessa página. Ele é um modelo diferente de GPT-6.1 Sol. Por isso, este levantamento não atribui um preço ao modelo anterior nem usa, sem aviso, as tarifas do mais novo. Modelos e unidades de cobrança ausentes da fonte, incluindo tarifas de embeddings, ficam fora desta tabela.
Qual modelo faz mais sentido para uma equipe pequena?
Comece um agente de programação ou aplicativo de uso geral com GPT-6.1 Sol e só mude quando os resultados das tarefas concluídas justificarem a troca. A recomendação se baseia no posicionamento da empresa e nos cálculos de orçamento, não em uma classificação de desempenho medida de forma independente.
As tarifas de entrada sem cache e de saída de Sol são um quinto das de Astra. A tarifa de entrada em cache é um décimo. Para uma equipe pequena que ainda está descobrindo quanto contexto um agente precisa, Sol oferece uma referência prática: dá para avaliar o trabalho antes de pagar o adicional de Astra em todas as solicitações.
Use Luna em tarefas restritas, com critérios claros de aprovação. Um classificador de atendimento que escolhe uma categoria conhecida ou um gerador de resumos que possam ser conferidos com o texto de origem é um candidato melhor do que uma tarefa de programação aberta. São sugestões de uso, não afirmações de que algum desses modelos já passou nas suas verificações. O preço baixo de Luna deixa de ajudar quando as falhas custam mais do que a economia em tokens.
Reserve Astra para trabalhos em que errar custa caro. No exemplo de programação abaixo, escolher Astra em vez de Sol acrescenta $410 por mês, com o mesmo volume cobrado. A troca se paga quando evita um valor maior de retrabalho. Um preço alto, por si só, não demonstra que isso vai acontecer.
Se a equipe já usa GPT-6 Sol, mantenha o orçamento atual até comparar o uso efetivamente cobrado e os resultados aprovados com os de GPT-6.1 Sol. Esta página não traz uma linha de preço que permita calcular a economia de uma migração do Sol anterior.

Quanto custa um milhão de tokens?
Não existe um preço único para um milhão de tokens da OpenAI. Token é uma unidade do conteúdo processado pelo modelo. Entrada é o conteúdo enviado; saída é o conteúdo gerado e cobrado. Entrada em cache é conteúdo reutilizado que a API cobra pela tarifa reduzida de cache.
Um milhão de tokens de entrada sem cache mais um milhão de tokens de saída custa $60 em Astra, $12 em Sol ou $0.60 em Luna. São dois milhões de tokens cobrados. Um milhão de tokens no total, dividido igualmente entre entrada sem cache e saída, custa $30, $6 ou $0.30, respectivamente.
Para calcular a conta de um modelo de texto, separe a entrada sem cache da entrada em cache:
Custo dos tokens = entrada sem cache / 1M × tarifa de entrada + entrada em cache / 1M × tarifa de cache + saída / 1M × tarifa de saída.
Se o registro de uso informa a entrada total e a entrada em cache, subtraia a segunda da primeira para obter a entrada sem cache. Cobrar toda a entrada pela tarifa sem cache e depois somar a entrada em cache de novo conta os mesmos tokens duas vezes.
Em Sol, a entrada em cache é 95% mais barata do que a entrada sem cache. Ainda assim, um milhão de tokens de saída custa o mesmo que 100 milhões de tokens de entrada em cache. Uma grande economia com cache não justifica gerar conteúdo sem limite. Conte toda a saída cobrada ao longo da tarefa do agente, em vez de orçar apenas a resposta final que o usuário vê.
Calculadora de tokens OpenAI: três cenários mensais
Os três cenários custam $159.40 por mês com a distribuição de tarefas sugerida. É um exemplo de planejamento para quem opera um aplicativo pequeno, não uma conta real de produção nem uma promessa de resultados equivalentes entre os modelos.
O exemplo pressupõe que cada solicitação individual fique abaixo de 272K de contexto, condição da fonte para os preços Standard. Os volumes em cache representam acertos de cache efetivamente cobrados. Os volumes de saída incluem toda a saída cobrada em todas as chamadas. O uso de ferramentas entra quando indicado; assinaturas, hospedagem e outras unidades de cobrança não especificadas ficam fora dos totais. Os cálculos usam as tarifas vigentes da OpenAI.
Bot de atendimento: $13.90 com Luna
Considere 10,000 conversas por mês. No conjunto de chamadas de cada conversa, reserve 1,000 tokens de entrada sem cache, 4,000 de entrada em cache e 500 de saída. O total mensal é de 10M de entrada sem cache, 40M de entrada em cache e 5M de saída. Considere também 1,000 chamadas de busca na web durante o mês.
Em Luna, os tokens custam:
10 × $0.10 + 40 × $0.01 + 5 × $0.50 = $3.90.
As buscas acrescentam $10, levando o total a $13.90, ou $1.39 por 1,000 conversas. Com o mesmo uso, Sol custa $74 em tokens mais $10 em buscas, totalizando $84. Astra custa $390 em tokens mais $10 em buscas, totalizando $400.
Luna é o candidato econômico se o bot tiver um escopo de atendimento delimitado e as respostas passarem nos critérios de aprovação. Essa conta pressupõe que o conteúdo reutilizado se qualifique para a cobrança em cache. Sem acertos de cache, todos os 50M de tokens de entrada são cobrados pela tarifa sem cache: o subtotal de tokens de Luna sobe para $7.50, e o total, para $17.50. Registre essa variação antes de tratar um acerto de cache esperado como economia garantida.
Agente de programação: $140 com Sol
Considere 1,000 tarefas de programação por mês. Somando todas as interações de cada tarefa, reserve 15,000 tokens de entrada sem cache, 100,000 de entrada em cache e 5,000 de saída. O mês usa, portanto, 15M de entrada sem cache, 100M de entrada em cache e 5M de saída. Uma tarefa pode envolver várias solicitações; os volumes são totais por tarefa.
Considere ainda 2,000 chamadas de busca na web e 1,000 sessões de contêiner, cada uma com 1 GB e a unidade de sessão de 20 minutos indicada pela fonte.
A conta de tokens de Sol é:
15 × $2 + 100 × $0.10 + 5 × $10 = $90.
As buscas custam $20, e os contêineres, 1,000 × $0.03 = $30. O total é de $140 por mês, ou $0.14 por tarefa.
Com os mesmos volumes cobrados, Astra custa $500 em tokens mais os mesmos $50 em ferramentas, totalizando $550. Luna custa $5 em tokens mais $50 em ferramentas, totalizando $55.
O modelo mais barato não elimina a conta das ferramentas. Trocar Sol por Luna economiza $85 por mês neste exemplo. Se o código produzido gerar mais de $85 de retrabalho adicional, a economia desaparece. Para migrar a Astra, a evidência precisa apontar na direção contrária: retrabalho evitado suficiente para justificar o adicional de $410. Uma comparação restrita a tokens não oferece esse critério de decisão.

Resumos em lote: $5.50 com Luna
Considere 20,000 documentos por mês, cada um com 4,000 tokens de entrada sem cache e 300 de saída. Isso gera 80M de tokens de entrada e 6M de saída. Não há acertos de cache nem cobranças de ferramentas previstos, e os resumos podem ser processados de forma assíncrona na janela de 24 horas da Batch API.
O custo dos tokens de Luna no modo Standard seria 80 × $0.10 + 6 × $0.50 = $11. Com o desconto de 50% de Batch informado pela fonte, o custo cai para $5.50 por mês, ou $0.275 por 1,000 resumos.
Os mesmos volumes em Batch custam $110 em Sol e $550 em Astra. Use o modelo mais barato quando os resumos atenderem ao padrão exigido; encaminhe documentos difíceis a um modelo mais capaz quando o custo de corrigi-los justificar a troca. Um cliente esperando uma resposta imediata representa outro tipo de uso e não deve entrar no orçamento como trabalho assíncrono em Batch.
Quanto fica o orçamento mensal combinado?
A distribuição sugerida soma $13.90 de atendimento com Luna + $140 de programação com Sol + $5.50 de resumos em Batch com Luna = $159.40.
Usar Sol nos três cenários custa $334. Usar Astra nos três custa $1,500. Usar Luna nos três custa $74.40, desde que o trabalho seja aprovado. As comparações mantêm constantes os volumes cobrados de tokens e ferramentas; não pressupõem que os modelos precisem do mesmo número de tentativas na prática.
Para quem opera o aplicativo, essa diferença determina a conta. Um modelo que precisa de mais interações pode consumir mais entrada, saída, buscas e sessões. Compare o custo por conversa aprovada, tarefa de programação concluída ou resumo utilizável antes de aplicar a menor tarifa ao produto inteiro.
Preços de Batch API e residência de dados na OpenAI
Batch reduz em 50% as cobranças informadas de entrada e saída; a residência de dados tem um adicional informado de 10%. A página de preços da OpenAI apresenta essas opções de processamento separadamente das tarifas Standard.
Batch executa trabalhos de forma assíncrona ao longo de 24 horas. É adequado para resumos de documentos durante a noite, classificação e outras tarefas cujo prazo comporte essa janela. O exemplo de resumos aplica o desconto apenas à entrada sem cache e à saída, sem pressupor desconto na tarifa de cache ou nas ferramentas.
Aplicar o adicional de residência de dados a um subtotal de $90 em tokens do modelo leva a $99, um acréscimo de $9. O exemplo não demonstra se buscas ou contêineres recebem o mesmo tratamento, nem como a residência de dados se combina com outros modos. A aba de preços não oferece detalhes suficientes para calcular essas combinações aqui.
A página também descreve o modo Fast e o processamento Flex. Fast é uma opção de velocidade com cobrança conforme o uso; Flex troca respostas mais lentas e indisponibilidade ocasional por menor custo. Essa aba não informa tarifas exatas para nenhum dos dois, por isso os orçamentos não inventam multiplicadores para eles.
As ferramentas podem definir o custo mínimo
Conte as buscas e as sessões de contêiner separadamente dos tokens do modelo. A estimativa de tokens pode estar correta e, ainda assim, o orçamento mensal ficar abaixo do necessário porque a tarefa aciona outros recursos pagos.
Quanto custa a busca na web pela API da OpenAI?
A busca na web custa $10 por 1,000 chamadas, e a página informa que os tokens do conteúdo das buscas são gratuitos. São $0.01 por chamada: 100 chamadas custam $1; 10,000 custam $100. O trabalho do modelo, cobrado separadamente, continua entrando no total de tokens. Fonte: preços da API da OpenAI.
No exemplo de atendimento, 1,000 buscas custam mais do que todo o subtotal de tokens de Luna. Decida a frequência de busca como parte do produto. Uma resposta que precisa de informações atuais pode justificar a consulta; uma resposta baseada em uma política de atendimento já fornecida não deveria receber automaticamente um custo de busca no orçamento.
Contêineres: a cobrança é por sessão
Contêineres, os ambientes de execução usados com os modelos, custam $0.03 para 1 GB ou $1.92 para 64 GB, por sessão de 20 minutos, por contêiner. A página de preços informa que essa cobrança por sessão começou em 31 de março de 2026, data já passada neste levantamento de outubro. O antigo texto “Now” não justifica presumir uma taxa única e permanente por contêiner. Fonte: preços da API da OpenAI.
O exemplo de programação adota deliberadamente 1,000 sessões de um GB. Isso não significa que toda tarefa de programação consuma exatamente uma sessão. Conte as sessões como uma unidade de cobrança própria, sobretudo quando as tarefas usam vários contêineres ou se estendem por mais unidades de sessão.
Com a tarifa informada para 64 GB, essas 1,000 sessões custariam $1,920. Mantendo os mesmos tokens de Sol e as mesmas buscas, o mês de programação passaria de $140 para $2,030. A tarifa de sessão do contêiner maior é 64 vezes a do menor. A página não informa preços de tamanhos intermediários, por isso nenhum valor foi interpolado aqui.
Quanto custa a Realtime API da OpenAI?
GPT-Realtime-2.1 tem preços diferentes para entradas de áudio, texto e imagem. Tokens de áudio são uma unidade de cobrança de voz; não devem ser tratados como tokens de texto nem convertidos em minutos por uma regra sem respaldo na fonte.
Um milhão de tokens de entrada de áudio sem cache mais um milhão de tokens de saída de áudio custa $32 + $64 = $96 em GPT-Realtime-2.1. Os mesmos volumes custam $10 + $20 = $30 em GPT-Realtime-2.1 mini. As entradas de texto e imagem têm linhas próprias na tabela. Fonte: preços da API da OpenAI.
Nas tarefas cobradas por tempo, GPT-Live-1 é o modelo de conversação, GPT-Live-Transcribe converte fala em texto ao vivo, GPT-Transcribe faz transcrição assíncrona e GPT-Realtime-Translate faz tradução em tempo real. Pelas tarifas por minuto exibidas, 1,000 minutos custam $50, $17, $4.50 ou $34, respectivamente. São tarefas diferentes, não planos de voz intercambiáveis. A página não fornece uma conversão que transforme o exemplo de tokens de áudio Realtime em um número equivalente de minutos.
Quanto custa gerar imagens pela API da OpenAI?
GPT-Image-2.5 Sunburst e GPT-Image-2.5 Flare têm as mesmas tarifas de tokens informadas. Ambos cobram $8 por entrada de imagem, $2 por entrada de imagem em cache e $30 por saída de imagem a cada milhão de tokens; prompts de texto custam $5 de entrada ou $1.25 de entrada em cache. A OpenAI posiciona Sunburst pela precisão de edição e Flare pela velocidade na geração do dia a dia. Fonte: preços da API da OpenAI.
Um cenário com um milhão de tokens de imagem gerada mais um milhão de tokens de prompts de texto sem cache custa $30 + $5 = $35 em qualquer um dos modelos. Isso não significa um milhão de imagens. A página de preços diz que imagens são convertidas em tokens, mas não estabelece uma quantidade fixa de tokens por imagem gerada para esse cálculo.
Planeje o custo de imagens a partir das unidades de imagem e texto efetivamente cobradas. Evite prometer um valor fixo por imagem com base em uma tarifa por token ou escolher entre esses modelos por uma diferença de preço que a página não apresenta.
Assinaturas, acesso gratuito e outras dúvidas de cobrança
Uma assinatura do ChatGPT não paga a conta de API do seu aplicativo. A OpenAI separa explicitamente a cobrança de API dos planos ChatGPT Plus, Business, Enterprise e Edu. Consulte o guia de preços do ChatGPT para decidir sobre a assinatura e faça um orçamento separado para o uso do aplicativo.
Como funciona o preço da API no Codex?
Codex é o produto de programação da OpenAI; a distinção relevante é como você paga pelo uso. Para orçar atividades de API cobradas à parte, use as unidades de modelo, tokens e ferramentas descritas acima. As franquias dos planos do produto são outra compra. O guia de preços do Codex trata dessa decisão de assinatura.
Comprar uma licença para um desenvolvedor não transforma o bot de atendimento, as tarefas automatizadas de programação ou os resumos em lote em uso de aplicativo pré-pago. Mantenha a despesa com assinaturas do produto e o gasto de API do aplicativo em linhas separadas do orçamento.
Existe API OpenAI gratuita?
A página de preços consultada não informa uma franquia geral de tokens gratuitos de API. Ela diz explicitamente que o uso do Playground, a interface no navegador para testar solicitações, é cobrado como o uso normal da API. Não considere os testes gratuitos só porque acontecem fora do aplicativo.
Quem usa apenas a experiência gratuita do ChatGPT pode nunca precisar comprar uso de API. Quando seu aplicativo faz solicitações pagas à API, a escolha por um aplicativo gratuito não serve de base para um orçamento de produção sem custos.
Essa fonte não informa um desconto universal de API para estudantes, uma política de reembolso de API, a validade de créditos ou um compromisso anual de preço dos tokens. As omissões não provam que não existam ofertas específicas para certas contas ou políticas separadas. Significam que este levantamento de preços não pode prometê-las. Em especial, não transfira condições de reembolso ou cobrança anual de uma assinatura para o orçamento de API.
Monte o orçamento da próxima semana com tarefas concluídas
Comece com Sol e meça a tarefa inteira antes de otimizar a tarifa do modelo. O próximo orçamento deve usar o consumo cobrado que você observou, não a quantidade de palavras da resposta final.
Registre uma referência de custo
Em tarefas representativas, registre entrada sem cache, entrada em cache, saída cobrada, buscas e sessões de contêiner em todas as interações. Guarde o resultado da avaliação de cada tarefa junto com seu custo.
Encaminhe tarefas delimitadas à opção adequada
Teste Luna em tarefas específicas cujos resultados possam ser conferidos. Envie para Batch o trabalho que pode esperar. Mantenha essa distribuição apenas quando a saída atender aos critérios de aprovação.
Compare o custo da troca com o retrabalho
Nas tarefas difíceis, compare o custo adicional de API de Astra com o valor das correções que ele evita. Use o número real de tentativas e o uso real de ferramentas, sem presumir que todos os modelos consumam a mesma quantidade de tokens.
O FAQ de preços da OpenAI informa que a aplicação do orçamento mensal pode sofrer atraso e que você continua responsável pelo consumo excedente. Trate o orçamento configurado como um controle de gastos sujeito a essa limitação e acompanhe o uso real. Para a estrutura de projetos e os procedimentos de recuperação, consulte o guia de controles de orçamento de API.
Perguntas frequentes
Quanto custa usar a OpenAI?
O uso da API da OpenAI é cobrado por modelo, tokens e ferramentas. Em solicitações Standard abaixo do limite de contexto indicado, Sol custa $2 de entrada, $0.10 de entrada em cache e $10 de saída por milhão de tokens. Essa tabela de API não oferece um preço mensal único para o aplicativo inteiro.
A API do ChatGPT sai mais barata que o ChatGPT Plus?
Depende do uso e do que você precisa. A conta de API de um aplicativo pode ser pequena, mas paga solicitações do aplicativo conforme o consumo, em vez da experiência do produto por assinatura. A OpenAI informa que o uso de API é cobrado separadamente das assinaturas do ChatGPT.
Como comparar os preços e custos de diferentes APIs de LLMs?
Coloque entrada, entrada em cache, saída, uso de ferramentas e conclusão bem-sucedida na mesma base antes de comparar fornecedores. O cenário de programação com volumes equivalentes apresentado aqui custa $55 em Luna, $140 em Sol e $550 em Astra, tendo a qualidade como condição de aprovação. Este levantamento não contém preços verificados de outros fornecedores.
Vale a pena pagar pela OpenAI?
Vale quando o trabalho aprovado economiza mais do que o custo de API e do retrabalho resultante. Comece as tarefas de programação com Sol; migre para Astra quando as correções evitadas justificarem o custo adicional e use Luna onde o trabalho passar pelos mesmos critérios exigidos.
Vale a pena pagar $20 pelo ChatGPT?
Pague por uma assinatura do ChatGPT quando os recursos e o tempo economizado justificarem a mensalidade. A assinatura não cobre o uso de aplicativo calculado aqui, então esse gasto de API continua sendo uma decisão separada.
A API da OpenAI é gratuita ou paga?
A página apresenta uso pago de modelos e ferramentas e não informa uma franquia geral gratuita de API. Também diz que as solicitações do Playground são cobradas como as solicitações normais da API. A experiência gratuita do ChatGPT não implica uso gratuito de API.
A API da OpenAI é cara?
Isso depende da tarefa e das ferramentas acionadas. O mês hipotético de atendimento custa $13.90 em Luna, enquanto o mês de programação com Sol custa $140. Os dois valores dependem dos volumes cobrados declarados; uma tarifa baixa de tokens não elimina as cobranças de buscas ou contêineres.
Quais são as melhores APIs gratuitas de IA?
A página de preços não informa uma franquia geral gratuita de API da OpenAI. Luna é uma opção paga de baixo custo para tarefas específicas cujos resultados passem nas suas verificações. A franquia gratuita de API de qualquer fornecedor precisa de uma verificação atual própria antes de entrar no orçamento de produção.
Quanto custa 1 milhão de tokens da OpenAI?
Para um milhão de tokens de entrada sem cache, Astra custa $10, Sol $2 e Luna $0.10. Para um milhão de tokens de saída, os valores são $50, $10 e $0.50. Um milhão de entrada mais um milhão de saída são dois milhões de tokens cobrados, totalizando $60, $12 ou $0.60.
A OpenAI oferece desconto de API para estudantes?
A página de preços verificada para este artigo não informa um desconto universal de API para estudantes. Não trate uma oferta estudantil de outro produto da OpenAI como crédito de API, a menos que os próprios termos prevejam explicitamente esse benefício.
Qual é a política de reembolso da API da OpenAI?
A página de preços verificada não informa uma política de reembolso de API. Por isso, este artigo não promete reembolsos nem aplica regras de assinatura do ChatGPT às compras de API.
O preço da API OpenAI mudou em 2026?
A página vigente informa explicitamente que a cobrança de contêineres por sessão de 20 minutos começou em 31 de março de 2026. Ela não traz um histórico de preços dos modelos; por isso, este levantamento de outubro não afirma quando os preços de tokens mudaram nem cita valores anteriores.
Defina as tarefas e os critérios de aprovação antes de escolher outro plano. Receba o checklist de auditoria de fluxos de trabalho com IA para empresas ao assinar a newsletter.
- Última atualização
- 3 de out. de 2026
- Categoria
- Build







