Claude Code 구독으로 Vercel AI SDK 에이전트 비용 줄이기
기존 Claude Code 구독을 Vercel AI SDK 에이전트 실행에 연결하면 어떤 계정에 모델 비용이 잡히는지 설명합니다. auto·direct·ai-gateway 인증 우선순위부터 공유 사용량 한도, 별도로 남는 Sandbox 비용, 팀별 운영 선택까지 한 번에 정리했습니다.

Vercel은 2026년 9월 14일, 임베디드 코딩 에이전트 비용을 어느 계정으로 결제할 수 있는지 바꿨습니다. 이제 AI SDK는 호스트에 이미 로그인된 Claude Code 구독 같은 지원 대상 에이전트 구독을 사용할 수 있습니다. 조건을 충족하는 모델 실행은 플랜 한도를 소진할 때까지 추가 비용이 $0입니다. 단, Sandbox 컴퓨팅 비용은 별도로 청구됩니다.
에이전트가 아니라 비용을 내는 계정이 바뀝니다
AI SDK에는 완전한 코딩 에이전트를 하나의 HarnessAgent 인터페이스 뒤에서 실행하는 계층이 있습니다. Vercel이 각 어댑터를 하네스라고 부르는 이유는 단순한 모델 호출보다 훨씬 많은 것을 감싸기 때문입니다. 에이전트마다 자체 툴, 워크스페이스 동작, 세션 상태, 권한, 컨텍스트 압축 기능을 함께 가져옵니다.
이 차이를 분명히 알아야 합니다. 이번 릴리스가 Claude Code, Codex, Cursor 같은 에이전트의 코딩 성능을 높여 주는 것은 아닙니다. 대신 어댑터가 자격 증명을 찾을 수 있는 새 경로, 즉 애플리케이션을 실행하는 머신에 저장된 네이티브 구독 세션을 제공합니다.
기존에는 임베디드 실행에 명시적인 제공업체 자격 증명이나 AI Gateway 자격 증명이 필요했습니다. 이제 조건을 충족하는 어댑터는 호스트에서 이미 인증된 구독을 대체 경로로 사용할 수 있습니다. 이를 감지하기 위해 애플리케이션 코드를 바꾸거나 설정을 추가할 필요도 없습니다.
릴리스 공지에 명시된 어댑터는 Claude Code, Cline, Codex, Cursor, fx, GitHub Copilot, Grok Build, OpenCode, Pi까지 아홉 가지입니다. 그렇다고 모든 계정에서 무조건 쓸 수 있다는 뜻은 아닙니다. 기반 에이전트가 구독 로그인을 지원해야 하며, 로그인으로 사용할 수 있는 범위 역시 해당 플랜의 규칙을 따릅니다.
비즈니스 관점에서 중요한 결과는 간단합니다. 같은 agent.generate() 호출이라도 주변 자격 증명에 따라 서로 다른 세 가지 예산 항목으로 잡힐 수 있습니다.
자격 증명 우선순위가 청구처를 결정합니다
인증 모드는 세 가지이며 기본값은 auto입니다. Claude Code나 Codex 같은 다이렉트 어댑터에서는 다음 순서로 적용된다고 보면 됩니다.
눈에 잘 띄지 않는 환경 변수 하나가 비용 회계를 바꾸는 지점입니다. direct 모드의 Claude Code 실행은 Claude 구독보다 ANTHROPIC_API_KEY 또는 ANTHROPIC_AUTH_TOKEN을 먼저 사용합니다. Codex 실행도 ChatGPT 이용 권한보다 OPENAI_API_KEY 또는 CODEX_API_KEY를 우선합니다.
auto에는 그 위에 한 단계가 더 있습니다. Gateway 자격 증명을 발견하면 제공업체 키나 구독보다 Gateway가 먼저 선택됩니다.
모든 어댑터에서 네트워크 경로와 결제 출처가 같은 것은 아닙니다. fx는 direct와 ai-gateway 모두 모델 요청을 AI Gateway로 보내지만, 적용 가능한 환경 자격 증명이 없고 ai-gateway를 선택하지 않았다면 이제 지원되는 네이티브 구독을 확인할 수 있습니다. 이 표를 보편적인 전송 경로로 간주하기 전에 반드시 해당 어댑터 페이지를 확인해야 합니다.

보안 경계도 격리된 머신에 원본 OAuth 토큰을 복사하는 방식보다 낫습니다. Vercel은 호스트에서 자격 증명을 확인하고 OAuth도 그곳에서 갱신합니다. Sandbox가 요청 변환을 지원하면 에이전트에는 자리표시자만 보이고, 호스트가 일치하는 외부 요청에만 실제 자격 증명을 주입합니다.
이 방식은 Sandbox로부터 비밀 정보를 보호합니다. 그렇다고 개인 구독이 회사 전체가 공유하는 용량으로 바뀌는 것은 아닙니다.
Claude Code 구독을 포함한 비용 계산법
모델 비용은 플랜 한도로 옮길 수 있지만, 런타임 비용까지 따라가지는 않습니다.
구독 플랜 한도
현재 가장 이해하기 쉬운 사례는 Claude Code입니다. Claude Pro는 월 결제 시 $20, 연 결제 시 $200이며, Claude Max는 Pro 사용량의 5x 또는 20x를 제공하는 플랜으로 월 $100 또는 $200입니다. 이미 이 플랜 중 하나를 이용하고 있다면, 네이티브 인증 조건을 충족하는 실행은 공유 한도를 소진할 때까지 별도 모델 비용이 추가되지 않습니다.
여기서는 공유라는 말이 핵심입니다. Anthropic의 현재 설명에 따르면 Claude Agent SDK, claude -p, 서드파티 Agent SDK 앱도 여전히 구독 한도를 사용합니다. claude.ai, Claude Code, Claude Desktop 역시 같은 사용량 한도에서 차감됩니다. Vercel의 Claude Code 어댑터는 Anthropic의 Agent SDK를 사용하므로, 임베디드 작업이 구독자의 다른 Claude 작업과 한도를 나눠 쓴다고 보는 것이 실무적으로 맞습니다.
OpenAI도 계량 방식은 다르지만 예산 구조는 같습니다. ChatGPT Plus는 월 $20이며, Codex는 ChatGPT 플랜에 포함되고 한도는 플랜별로 다릅니다. Codex의 에이전트 사용량 한도는 이용 가능한 지역에서 ChatGPT Work, ChatGPT for Excel, Workspace Agents와 공유됩니다. 자격을 갖춘 Plus 및 Pro 사용자는 기본 제공량을 모두 쓴 뒤 크레딧을 살 수 있지만, 이는 API 크레딧이 아닙니다.
따라서 구독 경로는 무료 추론이 아닙니다. 상한이 유동적인 선불 용량에 가깝습니다. 백그라운드 작업을 어댑터로 옮기면 오늘의 API 비용은 줄일 수 있지만, 내일 개인이 대화형 세션에서 쓸 수 있는 시간이 짧아질 수 있습니다.
제공업체 API 직접 결제
제공업체 키가 우선 적용되면 해당 제공업체의 종량제 계정으로 결제됩니다. Claude Sonnet 4.6의 현재 표준 API 요금은 입력 토큰 100만 개당 $3, 출력 토큰 100만 개당 $15입니다. OpenAI의 GPT-5.6 Luna는 입력 토큰 100만 개당 $0.20, 캐시된 입력 토큰 100만 개당 $0.02, 출력 토큰 100만 개당 $1.20입니다.
API 경로는 비용 귀속이 명확합니다. 그렇다고 코딩 에이전트 작업량까지 쉽게 예측되는 것은 아닙니다. 저장소 규모, 대화 기록, 추론 강도, 재시도, 툴 반복 횟수에 따라 토큰 사용량이 모두 달라집니다. 프롬프트 수가 아니라 완료된 작업 수를 측정해야 합니다.
AI Gateway
Gateway 자격 증명이 우선 적용되면 사용량은 AI Gateway에 기록됩니다. Vercel은 토큰 마크업이나 플랫폼 수수료 없이 상위 제공업체의 정가를 청구합니다. 일반적으로 선불 Gateway 크레딧으로 결제하며, Enterprise 고객은 Vercel 통합 청구서를 사용할 수 있습니다.
이 경로를 선택하면 팀의 지출 창구를 하나로 모을 수 있습니다. 또한 Gateway 예산을 사용할 수 있습니다. 네이티브 구독을 이용해 Gateway를 우회한 실행에는 이 통제가 적용되지 않으므로, 한계비용 절감과 중앙 예산 관리 중 무엇을 우선할지 의도적으로 선택해야 합니다.
Sandbox 컴퓨팅
모든 AI SDK 에이전트 런타임은 여전히 Sandbox에서 동작합니다. Vercel의 기본 iad1 리전에서 Sandbox 요금은 Active CPU 시간당 $0.128, 프로비저닝된 메모리 GB당 시간당 $0.0212입니다. 프로세스가 모델이나 네트워크 I/O를 기다리는 동안 CPU 과금은 멈추지만, 메모리는 전체 실행 시간 동안 계속 과금됩니다.
Vercel의 AI 코드 검증 예시는 vCPU 2개와 메모리 4GB로 5분간 실행됩니다. CPU 사용률이 100%라면 비용은 약 $0.03입니다. $20의 Pro 크레딧 전부를 이와 정확히 같은 작업에만 쓸 수 있다고 가정하면, 유료 Sandbox 사용으로 넘어가기 전까지 대략 666회 실행할 수 있다는 계산이 나옵니다. 실제 용량은 다른 Vercel 서비스가 크레딧을 사용할 수 있고, 작업마다 필요한 리소스가 다르며, 전송이나 스토리지 비용이 추가될 수 있어 달라집니다.
전체 예산 구조를 정리하면 다음과 같습니다.
- 구독 경로: 기존 플랜 가격과 공유 한도, 그리고 Sandbox 비용.
- 제공업체 경로: 제공업체의 종량제 토큰 비용과 Sandbox 비용.
- Gateway 경로: Gateway 잔액 또는 청구서에 제공업체 정가로 잡히는 토큰 비용과 Sandbox 비용.
상황별로 어떤 결제 경로를 선택해야 할까?
내부 저장소 도우미를 운영하는 1인 창업자
이미 Claude Pro나 ChatGPT Plus를 쓰는 창업자라면 사용량이 적은 테스트 수정 또는 저장소 요약 툴을 HarnessAgent 뒤에 두고 direct를 선택해, 조건을 충족하는 모델 작업을 네이티브 플랜으로 처리할 수 있습니다. 파일럿 단계에서 별도의 모델 잔액을 충전하지 않아도 된다는 점이 이점입니다.
범위는 내부 작업으로 한정하고 제공업체의 사용량 페이지를 지켜봐야 합니다. 같은 구독으로 터미널과 앱 작업도 결제하므로, 백그라운드 작업이 그날 나중에 필요한 용량을 먼저 소진할 수 있습니다.
운영 업무를 표준화하는 에이전시 기술 책임자
에이전시는 담당자가 정해진 저장소 작업을 각자 수행하게 하고, 호스트에서는 해당 담당자의 조건 충족 구독을 사용할 수 있습니다. 여기서 핵심 통제 지점은 어댑터 선택이 아니라 실행 전에 제공업체 API 환경 변수가 없는지 확인하는 것입니다.
그러면 재무팀에도 명확한 원칙을 제시할 수 있습니다. 범위가 제한된 내부 작업에는 플랜 한도를 먼저 쓰고, 키를 의도적으로 마운트했을 때만 제공업체 API를 사용합니다. 한 사람의 로그인을 에이전시 전체가 공유하는 일도 피할 수 있습니다.
공유 자동화를 운영하는 개발자 플랫폼 팀
플랫폼 팀이라면 무인 작업이나 공유 작업은 대체로 ai-gateway에 고정하는 편이 좋습니다. 구독 구간의 $0 추가 비용은 포기해야 하지만, 결제 주체와 크레딧 풀 또는 청구서를 하나로 모으고 개인이 아닌 서비스 단위로 지출을 통제할 수 있습니다.
이전 fx 어댑터 해설에서 짚은 중요한 내용은 여전히 유효합니다. fx의 두 모드는 모두 모델 요청을 AI Gateway로 보냅니다. 9월 14일에 달라진 것은 자격 증명의 대체 경로입니다. 이제 더 높은 우선순위의 자격 증명이 없을 때 지원되는 네이티브 구독을 사용할 수 있으므로, 설정과 비용 설명에도 이를 반영해야 합니다.
고객에게 에이전트 작업을 판매하는 SaaS 창업자
고객용 코딩 기능의 용량 계획을 직원 한 명의 구독에 의존해서는 안 됩니다. 고객 트래픽은 여러 사람이 공유하고 변동 폭이 크며, 담당자가 바뀌어도 계속 처리되어야 합니다. 소유자가 명확한 AI Gateway 또는 제공업체 API 계정을 사용하고, 단위 경제성 계산에는 Sandbox 비용까지 포함해야 합니다.
별도의 구독형 에이전트 비교 글은 개발자 한 명이 이미 보유한 플랜과 함께 어떤 로컬 또는 오픈소스 클라이언트를 써야 하는지 다룹니다. 이번 릴리스의 초점은 지원되는 런타임을 AI SDK 애플리케이션 안에 임베드하는 것입니다. 로그인 방식은 비슷할 수 있지만 운영 모델은 다릅니다.
Claude Code 구독 한도로 작업 하나 실행하기
이 경로는 지정된 사용자가 Claude Code에 이미 로그인한 호스트에서 범위가 제한된 내부 작업을 실행할 때 적합합니다. 문서에 나온 Claude Code 어댑터 설정에 따라 의도적으로 direct를 선택하므로, Vercel OIDC 토큰으로 Sandbox를 인증하면서도 모델 작업이 Gateway로 향하지 않게 할 수 있습니다.
문서에 명시된 패키지 설치
기존 Node 프로젝트에 코어 에이전트 패키지, Claude Code 어댑터, Vercel Sandbox 어댑터를 추가합니다.
Bashpnpm add @ai-sdk/harness @ai-sdk/harness-claude-code @ai-sdk/sandbox-vercel호스트에서 로그인
같은 호스트에서 Claude Code를 실행한 뒤, 조건을 충족하는 구독이 연결된 Claude 계정을 선택합니다.
BashclaudeSandbox용
VERCEL_OIDC_TOKEN은 그대로 둡니다. 구독으로 결제하려면 프로세스 환경을 확인하고 이번 실행에서ANTHROPIC_API_KEY와ANTHROPIC_AUTH_TOKEN을 제거해야 합니다. 두 제공업체 변수 중 어느 하나라도 있으면 네이티브 로그인보다 먼저 적용됩니다.다이렉트 경로 강제 지정
아래 내용을
agent.mjs로 저장합니다. 문서에 명시된direct선택자, 현재node24Sandbox 런타임, 브리지에 필요한 노출 포트4000을 사용합니다.JavaScriptimport { HarnessAgent } from '@ai-sdk/harness/agent'; import { createClaudeCode } from '@ai-sdk/harness-claude-code'; import { createVercelSandbox } from '@ai-sdk/sandbox-vercel'; const agent = new HarnessAgent({ harness: createClaudeCode({ auth: 'direct' }), model: 'claude-sonnet-4-6', sandbox: createVercelSandbox({ runtime: 'node24', ports: [4000], }), }); const session = await agent.createSession(); let exitCode = 0; try { const result = await agent.generate({ session, prompt: 'Create a short TODO.md for this repository.', }); console.log(result.text); } catch (err) { exitCode = 1; console.error(err); } finally { await session.destroy(); process.exit(exitCode); }두 결제 기록 모두 확인
영향이 적은 작업 하나를 실행합니다. 제공업체의 사용량 페이지에서 플랜 한도가 줄었고 새 API 비용은 발생하지 않았는지 확인한 다음, Vercel Usage에서 Sandbox 항목도 확인합니다.
AI Gateway에 모델 요청이 기록됐다면 Gateway 자격 증명이 우선 적용된 것입니다. 제공업체 API 대시보드에 비용이 잡혔다면 제공업체 자격 증명이 우선한 것입니다. 파일럿을 확대하기 전에 중단하고 환경부터 수정해야 합니다.
반드시 알아야 할 한계
네이티브 로그인은 호스트에 귀속됩니다. 애플리케이션의 모든 고객에게 바로 제공할 수 있는 OAuth 흐름이 아니며, 개인별 한도를 팀 전체가 공유하는 풀로 합쳐 주지도 않습니다.
플랜 용량도 고정되어 있지 않습니다. OpenAI에 따르면 Codex 한도는 플랜과 작업에 따라 달라집니다. Anthropic은 Claude 사용량이 모델, 작업 복잡도, 컨텍스트, 작업 강도에 따라 달라진다고 설명합니다. 어느 쪽도 이 Vercel 경로에 고정된 프로덕션 작업 횟수를 보장하지 않습니다.
AI SDK 에이전트 패키지는 여전히 실험 단계이며, 릴리스 사이에 호환성을 깨는 변경이 생길 수 있습니다. 측정 가능한 내부 파일럿에는 감수할 수 있는 조건입니다. 하지만 고객에게 약속하기 전에는 의존성 버전을 고정하고, 자격 증명 선택을 테스트하며, Gateway 또는 제공업체 경로를 예비 수단으로 준비해야 합니다.
월요일에 바로 할 일
내부 저장소 작업 하나와 조건을 충족하는 사용자 한 명을 정합니다. 어댑터를 direct로 설정하고 해당 호스트의 제공업체 변수를 점검한 뒤, 작업을 한 번 실행합니다. 어느 결제 대시보드의 수치가 움직였는지, 구독 한도가 바뀌었는지, Sandbox 비용은 얼마였는지, 작업은 완료됐는지를 기록합니다.
지원 대상 플랜을 이미 보유하고 범위가 제한된 내부 워크플로가 있다면 이번 주에 시작해도 좋습니다. 기반 에이전트가 구독 로그인을 지원하지 않거나 패키지의 실험 상태가 조직의 의존성 정책에 맞지 않는다면 기다리는 편이 낫습니다. 중앙 예산과 공유 프로덕션 소유권이 모델 비용의 한계 절감보다 중요하다면 ai-gateway를 유지해야 합니다. 일반 AI SDK 모델 제공업체만 호출하고 HarnessAgent를 전혀 사용하지 않는다면 이번 변경의 영향을 받지 않습니다.
실제 예산과 워크플로를 바꾸는 AI 툴을 운영 관점에서 계속 살펴보려면 뉴스레터를 구독하세요.
- 마지막 업데이트
- 2026년 9월 15일
- 카테고리
- Explained







