Agentes de IA no Vercel AI SDK: a assinatura pode pagar a conta
O Vercel AI SDK agora usa assinaturas compatíveis de agentes de IA. Veja qual credencial define a cobrança, qual plano paga e quanto o Sandbox ainda custa.

Vercel mudou, em 14 de setembro de 2026, qual conta pode pagar por um agente de programação incorporado. Agora, o Vercel AI SDK pode usar uma assinatura compatível de agentes de IA que já esteja conectada no host. Com isso, a próxima execução elegível do modelo gera $0 de custo incremental até a franquia do plano acabar. A computação do Sandbox continua sendo cobrada à parte.
Para os agentes de IA, muda quem paga — não o agente
O AI SDK oferece uma camada para executar agentes de programação completos por trás de uma única interface HarnessAgent. A Vercel chama cada adaptador de harness porque ele envolve muito mais do que uma chamada ao modelo: o agente leva suas próprias ferramentas, seu comportamento no workspace, o estado da sessão, as permissões e a compactação.
Essa diferença importa. A novidade não torna Claude Code, Codex, Cursor ou qualquer outro agente melhor em programação. O que ela faz é dar ao adaptador um novo lugar onde procurar credenciais: uma sessão de assinatura nativa armazenada na máquina que executa a aplicação.
Antes dessa mudança, uma execução incorporada exigia uma credencial explícita do provedor ou do AI Gateway. Agora, um adaptador elegível pode recorrer à assinatura já autenticada no host. A descoberta não exige nenhuma mudança no código da aplicação nem uma nova configuração.
O anúncio cita nove adaptadores: Claude Code, Cline, Codex, Cursor, fx, GitHub Copilot, Grok Build, OpenCode e Pi. Isso não significa que toda conta esteja automaticamente coberta. O agente usado ainda precisa aceitar login por assinatura, e as regras do próprio plano continuam determinando quanto essa sessão pode consumir.
Na prática, a consequência para o negócio é simples: a mesma chamada agent.generate() pode cair em três centros de custo diferentes, conforme as credenciais disponíveis no ambiente.
A ordem das credenciais decide quem paga
Há três modos de autenticação. O padrão é auto. Para adaptadores diretos como Claude Code e Codex, a ordem prática é esta:
É aqui que uma variável de ambiente esquecida muda a contabilidade. Uma execução do Claude Code em modo direct usa ANTHROPIC_API_KEY ou ANTHROPIC_AUTH_TOKEN antes da assinatura Claude. No Codex, OPENAI_API_KEY ou CODEX_API_KEY têm prioridade sobre o benefício do ChatGPT.
O modo auto acrescenta mais um nível acima desses. Se encontrar uma credencial do Gateway, ele escolhe o Gateway antes da chave do provedor ou da assinatura.
Rota de rede e origem da cobrança não são a mesma coisa para todos os adaptadores. O fx ainda envia as solicitações do modelo pelo AI Gateway nos modos direct e ai-gateway, mas agora consegue localizar uma assinatura nativa compatível quando não há uma credencial de ambiente aplicável e o modo ai-gateway não foi escolhido. Consulte a página do adaptador antes de tratar esta tabela como um mapa universal de transporte.

Esse isolamento de segurança é melhor do que copiar um token OAuth bruto para uma máquina isolada. A Vercel resolve as credenciais no host e renova a autenticação OAuth ali. Quando o sandbox aceita transformação de solicitações, o agente recebe um placeholder, e o host injeta a credencial real apenas na solicitação de saída correspondente.
Isso protege o segredo do sandbox. Não transforma uma assinatura pessoal em capacidade compartilhada para a empresa.
Como fica a conta
A cobrança do modelo pode migrar para uma franquia. A cobrança da infraestrutura de execução não acompanha essa mudança.
Franquia da assinatura
Claude Code é o exemplo atual mais claro. O Claude Pro custa $20 no pagamento mensal ou $200 no plano anual, enquanto o Claude Max custa $100 ou $200 por mês para oferecer 5x ou 20x o uso do Pro. Para quem já paga por um desses planos, uma execução elegível com autenticação nativa não acrescenta uma cobrança separada pelo modelo até esgotar a franquia compartilhada.
O termo compartilhada é decisivo. A Anthropic informa atualmente que Claude Agent SDK, claude -p e aplicativos de terceiros baseados no Agent SDK continuam consumindo os limites da assinatura. A empresa também diz que claude.ai, Claude Code e Claude Desktop contam para o mesmo limite de uso. Como o adaptador Claude Code da Vercel usa o Agent SDK da Anthropic, a leitura prática é que o trabalho incorporado disputa a franquia com as outras atividades do assinante no Claude.
Na OpenAI, a lógica de orçamento é a mesma, embora os medidores sejam diferentes. O ChatGPT Plus custa $20 por mês, o Codex está incluído nos planos ChatGPT e os limites variam conforme o plano. O Codex compartilha uma franquia de uso para agentes com ChatGPT Work, ChatGPT for Excel e Workspace Agents nos locais onde esses produtos estão disponíveis. Usuários elegíveis dos planos Plus e Pro podem comprar créditos depois de consumir o uso incluído, mas esses créditos não são créditos de API.
Portanto, a rota da assinatura não oferece inferência gratuita. Trata-se de capacidade pré-paga com um teto variável. Levar jobs em segundo plano para o adaptador pode reduzir a cobrança de API hoje e encurtar a sessão interativa da pessoa amanhã.
API direta do provedor
Se uma chave do provedor tiver prioridade, a cobrança vai para a conta faturada por uso desse provedor. O Claude Sonnet 4.6 custa atualmente $3 por milhão de tokens de entrada e $15 por milhão de tokens de saída nas tarifas padrão da API. O GPT-5.6 Luna da OpenAI custa $0.20 por milhão de tokens de entrada, $0.02 por milhão de tokens de entrada em cache e $1.20 por milhão de tokens de saída.
Esses preços facilitam atribuir o custo da rota de API. Isso não torna simples prever o custo de uma tarefa de um agente de programação. Tamanho do repositório, histórico da conversa, esforço de raciocínio, novas tentativas e loops de ferramentas alteram o uso de tokens. Meça tarefas concluídas, não prompts.
AI Gateway
Se uma credencial do Gateway tiver prioridade, o consumo aparece no AI Gateway. A Vercel cobra o preço de tabela do provedor, sem acréscimo sobre tokens nem tarifa de plataforma. A forma de pagamento habitual é o saldo pré-pago do Gateway; clientes Enterprise podem usar uma fatura consolidada da Vercel.
Essa rota oferece à equipe um único lugar para acompanhar os gastos. Também permite usar os orçamentos do Gateway. Esses controles não acompanham uma execução que ignora o Gateway em favor de uma assinatura nativa. Por isso, a escolha entre economia marginal e controle central do orçamento precisa ser intencional.
Computação do Sandbox
Todo ambiente de execução de agentes do AI SDK continua operando em um sandbox. Na região padrão iad1 da Vercel, o Sandbox custa $0.128 por hora de CPU ativa e $0.0212 por GB-hora provisionado. A CPU pausa enquanto o processo aguarda E/S do modelo ou da rede, mas a memória continua alocada durante todo o tempo de execução.
O exemplo de validação de código com IA da própria Vercel roda por cinco minutos com duas vCPUs e quatro GB de memória. O custo é de cerca de $0.03 com 100% de uso de CPU. Se todo o crédito de $20 do Pro estivesse disponível apenas para essa carga exata, a conta daria um teto aproximado de 666 execuções antes de começar o uso pago do Sandbox. A capacidade real será diferente, pois outros serviços da Vercel podem consumir o crédito, as tarefas usam recursos distintos e transferência ou armazenamento podem acrescentar custos.
Esse é o orçamento completo:
- Rota da assinatura: preço do plano existente, franquia compartilhada e Sandbox.
- Rota do provedor: tokens medidos pelo provedor e Sandbox.
- Rota do Gateway: tokens pelo preço de tabela do provedor, cobrados do saldo ou da fatura do Gateway, e Sandbox.
Qual rota faz sentido para cada caso
Fundador solo com um assistente interno para o repositório
Um fundador que já assina Claude Pro ou ChatGPT Plus pode colocar uma ferramenta de baixo volume para corrigir testes ou resumir o repositório por trás de HarnessAgent, selecionar direct e deixar o plano nativo cobrir o trabalho elegível do modelo. O ganho é não precisar provisionar outro saldo para o modelo durante o piloto.
Mantenha o escopo interno e acompanhe a página de uso do provedor. A assinatura também paga pelo trabalho do fundador no terminal e nos aplicativos; portanto, um job em segundo plano pode consumir a capacidade que faria falta mais tarde no mesmo dia.
Líder técnico de agência padronizando tarefas operacionais
Uma agência pode atribuir a cada operador identificado uma tarefa bem delimitada em um repositório e usar no host a assinatura elegível desse profissional. O principal controle não é a escolha do adaptador, e sim verificar antes da execução se as variáveis de API do provedor estão ausentes.
Assim, o financeiro ganha uma regra clara: primeiro a franquia do plano para trabalho interno e delimitado; a API do provedor só entra quando uma chave é disponibilizada de propósito. Isso também evita compartilhar o login de uma pessoa com toda a agência.
Equipe de plataforma executando automação compartilhada
Em geral, uma equipe de plataforma deve fixar jobs compartilhados ou sem supervisão em ai-gateway. Isso abre mão da janela de custo incremental de $0 da assinatura, mas oferece à equipe um único responsável pela cobrança, uma única reserva de créditos ou uma fatura e controles de gastos alinhados ao serviço — não a uma pessoa.
O guia anterior sobre o adaptador fx continua correto em um ponto importante: nos dois modos do fx, as solicitações do modelo passam pelo AI Gateway. O que mudou em 14 de setembro foi o fallback de credenciais. Agora, as partes de configuração e custos precisam considerar uma assinatura nativa compatível quando nenhuma credencial de prioridade maior assume a execução.
Fundador de SaaS vendendo trabalho de agentes aos clientes
Um recurso de programação voltado ao cliente não deve usar a assinatura de um funcionário como plano de capacidade. O tráfego dos clientes é compartilhado, varia e precisa continuar funcionando mesmo quando a equipe muda. Use o AI Gateway ou uma conta de API do provedor com um responsável explícito e inclua o Sandbox na economia unitária.
A comparação independente de agentes por assinatura responde qual cliente local ou open source um desenvolvedor deve escolher para usar com um plano que já possui. Esta novidade trata de incorporar um ambiente de execução compatível a uma aplicação do AI SDK. O login pode ser parecido; o modelo operacional, não.
Como usar a assinatura do Claude Code para rodar um job
Esta rota serve para um job interno e delimitado em um host no qual o usuário identificado já fez login no Claude Code. Ela seleciona direct de propósito, usando a configuração documentada do adaptador Claude Code, para que o token OIDC da Vercel autentique o Sandbox sem encaminhar o trabalho do modelo ao Gateway.
Instale os pacotes documentados
Em um projeto Node existente, adicione o pacote principal do agente, o adaptador Claude Code e o adaptador Vercel Sandbox.
Bashpnpm add @ai-sdk/harness @ai-sdk/harness-claude-code @ai-sdk/sandbox-vercelFaça login no host
Execute o Claude Code no mesmo host e escolha a conta Claude com a assinatura elegível.
BashclaudeMantenha
VERCEL_OIDC_TOKENdisponível para o Sandbox. Verifique o ambiente do processo e removaANTHROPIC_API_KEYeANTHROPIC_AUTH_TOKENdesta execução se a assinatura tiver de pagar. Qualquer uma dessas variáveis do provedor tem prioridade sobre o login nativo.Force a rota direta
Salve o código como
agent.mjs. Ele usa o seletor documentadodirect, o runtime atualnode24do Sandbox e a porta exposta4000, exigida pela ponte.JavaScriptimport { HarnessAgent } from '@ai-sdk/harness/agent'; import { createClaudeCode } from '@ai-sdk/harness-claude-code'; import { createVercelSandbox } from '@ai-sdk/sandbox-vercel'; const agent = new HarnessAgent({ harness: createClaudeCode({ auth: 'direct' }), model: 'claude-sonnet-4-6', sandbox: createVercelSandbox({ runtime: 'node24', ports: [4000], }), }); const session = await agent.createSession(); let exitCode = 0; try { const result = await agent.generate({ session, prompt: 'Create a short TODO.md for this repository.', }); console.log(result.text); } catch (err) { exitCode = 1; console.error(err); } finally { await session.destroy(); process.exit(exitCode); }Confira os dois registros de cobrança
Execute uma tarefa inofensiva. Confirme que a página de uso do provedor registra consumo da franquia do plano sem uma nova cobrança de API. Depois, confira em Vercel Usage a linha do Sandbox.
Se o AI Gateway registrar a solicitação do modelo, uma credencial do Gateway teve prioridade. Se o painel da API do provedor registrar uma cobrança, uma credencial do provedor venceu. Pare e corrija o ambiente antes de ampliar o piloto.
Limites, sem rodeios
O login nativo fica vinculado ao host. Ele não é um fluxo OAuth pronto para todos os clientes da aplicação e não reúne franquias individuais em um pool para a equipe.
A capacidade do plano também varia. A OpenAI afirma que os limites do Codex dependem do plano e da tarefa. A Anthropic diz que o uso do Claude depende do modelo, da complexidade da tarefa, do contexto e do esforço. Nenhuma das duas estabelece um número fixo de jobs de produção para esta rota da Vercel.
Os pacotes de agentes do AI SDK continuam experimentais, e mudanças incompatíveis podem ocorrer entre versões. Isso é aceitável em um piloto interno monitorado. Também é um motivo para fixar dependências, testar a seleção de credenciais e manter pronta uma rota pelo Gateway ou pelo provedor antes de transformar esse recurso em promessa para clientes.
O que fazer na segunda-feira
Escolha uma tarefa interna no repositório e um usuário elegível. Defina o adaptador como direct, faça um inventário das variáveis do provedor nesse host, execute a tarefa uma vez e registre qual painel de cobrança mudou, se a franquia da assinatura foi afetada, qual foi a cobrança do Sandbox e se a tarefa terminou.
Faça isso nesta semana se já houver um plano compatível e um workflow interno bem delimitado. Espere se o agente usado não aceitar login por assinatura ou se o status experimental do pacote estiver fora da política de dependências. Permaneça em ai-gateway se orçamentos centrais e responsabilidade compartilhada pela produção forem mais importantes do que a economia marginal no modelo. Nada muda para quem chama provedores comuns de modelos do AI SDK e nunca usa HarnessAgent.
Para receber mais análises práticas sobre as ferramentas de IA que estão mudando orçamentos e workflows reais, assine a newsletter.
- Última atualização
- 15 de set. de 2026
- Categoria
- Explained







