코딩 에이전트를 위한 최고의 AI 게이트웨이
코딩 에이전트 팀에 맞는 AI 게이트웨이를 비교합니다. Vercel, Requesty, LiteLLM, OpenRouter, Portkey, Cloudflare의 가격·라우팅·거버넌스·셀프 호스팅 차이를 한눈에 확인하세요. 월 $2,000 기준 비용과 팀별 선택 기준까지 정리했습니다.

Vercel AI Gateway는 명령어 하나로 아홉 개 에이전트를 설정할 수 있고 기본 토큰 계층에 마크업이 없어, 대부분의 코딩 에이전트 팀에 가장 적합한 AI 게이트웨이입니다. 월 모델 사용료가 $2,000라면 선택형 제어 기능을 제외한 게이트웨이 비용은 Vercel이 $0, Requesty가 $100, OpenRouter가 $110입니다. 이제 게이트웨이는 실험용 도구가 아니라 엔지니어링 예산으로 판단해야 합니다.
한눈에 보는 결론: 코딩 에이전트에 어떤 AI 게이트웨이가 맞을까요?
배포 방식이나 비용 귀속, 거버넌스에 특별한 요구사항이 없다면 Vercel AI Gateway를 선택하면 됩니다. Claude Code, Codex, Cursor, OpenCode마다 따로 관리하던 설정을 하나의 모델 청구서, 하나의 폴백 체계, 하나의 지출 화면으로 통합하는 과정이 현재 가장 간단합니다.
다섯 가지 경우에는 Vercel이 아닌 다른 선택이 더 낫습니다. 어떤 저장소나 브랜치, 개발자가 비용을 만들었는지가 재무팀의 핵심 질문이라면 Requesty를 선택합니다. 모델 트래픽과 공급자 키를 직접 운영하는 인프라 안에 둬야 한다면 **LiteLLM**이 맞습니다. 에이전트별 설정 편의보다 가장 넓은 모델·공급자 카탈로그가 중요하면 OpenRouter를 고릅니다. 관리형 가드레일과 서킷 브레이커, 정책이 예산을 배정받은 요구사항이라면 **Portkey**가 적합합니다. 이미 Workers와 Cloudflare 로그, Cloudflare 보안을 제어 계층으로 쓰고 있다면 **Cloudflare AI Gateway**를 선택합니다.
AI 게이트웨이는 코딩 에이전트와 모델 공급자 사이에 놓이는 제어 계층입니다. 코딩 에이전트는 그대로 계획을 세우고, 파일을 수정하고, 명령을 실행하고, 툴을 호출합니다. 게이트웨이는 모델 요청을 어디로 보낼지, 얼마까지 쓰게 할지, 어느 공급자가 처리할지, 타임아웃 뒤에 어떻게 대응할지, 무엇을 기록할지를 결정합니다.
이 차이를 분명히 알아야 합니다. 게이트웨이가 성능이 낮은 코딩 모델을 더 똑똑하게 만들거나, 부실한 저장소 지침 파일을 고치거나, 위험한 코드를 검토해 주지는 않습니다. 대신 공급자 장애로 긴 작업이 중단되는 일을 막고, 폭주한 키의 비용을 제한하며, 마이그레이션 브랜치가 일상적인 버그 수정의 네 배에 이르는 모델 예산을 썼다는 사실을 보여줄 수 있습니다. 지능이 아니라 통제를 위해 구매해야 합니다.
코딩 에이전트가 AI 게이트웨이를 예산 항목으로 바꾸는 이유
코딩 에이전트는 작은 라우팅 결정을 운영비 결정으로 키웁니다. 작업 하나가 연속된 모델 호출을 만들기 때문입니다. 채팅 답변은 응답 한 번이면 끝날 수 있지만, 코딩 에이전트는 저장소를 살피고, 심볼을 검색하고, 패치를 제안하고, 테스트를 실행하고, 실패 결과를 읽고, 패치를 수정한 뒤 더 강한 모델에 결과 검토까지 요청할 수 있습니다.
Vercel의 프로덕션 인덱스에서는 요청의 22.2%가 전체 토큰의 58.9%를 사용했습니다. 툴을 사용하는 요청이 나머지 트래픽보다 토큰을 약 2.6배 더 많이 소비한 셈입니다. 같은 데이터셋에서 폴백이 요청의 3.5%를 복구한 것으로 나타났습니다. 10,000건의 요청으로 구성된 워크로드가 이 전체 분포와 같다고 가정하면 약 350건의 요청이 첫 공급자에서 실패하지 않고 폴백을 통해 완료됩니다. 다른 워크로드에도 같은 복구율을 보장한다는 뜻은 아니지만, 안정성을 모델 가격과 함께 따져야 하는 이유는 충분히 보여줍니다.
상위 모델 비용을 고정하면 기본 게이트웨이 요금을 더 쉽게 비교할 수 있습니다. 공급자 정가 기준 추론 비용이 월 $2,000일 때:
- Vercel의 토큰 마크업은 $0입니다.
- Requesty의 5% 마크업은 $100을 더합니다.
- OpenRouter의 Pay as you go 수수료 5.5%는 $110을 더합니다.
- Cloudflare Unified Billing을 통해 크레딧을 구매하면 $100이 더해집니다.
- Portkey는 기록 로그 100,000건당 월 $49부터 시작하며, 토큰 지출과는 다른 과금 기준을 씁니다.
- LiteLLM의 오픈소스 라이선스 비용은 $0이지만, 호스팅과 운영 인력은 직접 부담해야 합니다.

백분율 차이만으로 결론을 내릴 수는 없습니다. 브랜치별 비용 귀속 덕분에 통제되지 않은 저장소 하나가 훨씬 큰 비용을 쓰는 일을 막는다면 Requesty의 추가 $100은 저렴할 수 있습니다. 서킷 브레이커가 릴리스 워크플로를 지켜 준다면 Portkey의 $49도 아깝지 않습니다. 반대로 플랫폼 엔지니어가 프록시의 상시 당직 담당자가 된다면 LiteLLM의 무료 라이선스가 오히려 비쌀 수 있습니다.
게이트웨이는 모델과 공급자, 에이전트 실행 환경을 바꾸는 비용을 줄여야 합니다. 공급자 청구서 여섯 장을 일곱 번째 청구서로 바꾸는 데 그친다면 도입할 가치가 없습니다.
코딩 에이전트용 AI 게이트웨이 선정 기준
여섯 제품은 일반적인 API 기능 체크리스트가 아니라 코딩 에이전트가 실제로 만드는 업무를 기준으로 평가했습니다. 가격과 제품 페이지는 2026년 8월 15일에 확인했습니다. 이번 평가에서 제품을 프로덕션에 직접 투입하지는 않았으므로, 순위는 현재 문서와 표준화한 비용 분석, 각 제품 경계가 가져오는 결과를 바탕으로 정했습니다.
순위를 가른 기준은 여섯 가지입니다.
- 코딩 에이전트 실행 환경 설정: Claude Code, Codex, Cursor와 관련 에이전트의 설정법을 명시한 게이트웨이는 OpenAI 호환 엔드포인트만 내세우는 제품보다 통합 위험이 작습니다.
- 라우팅 안정성: 공급자 순서, 타임아웃, 재시도, 모델 폴백, 서킷 브레이커가 중요합니다. 에이전트는 긴 호출 사슬의 마지막 모델 요청에서 전체 작업을 잃을 수 있기 때문입니다.
- 비용 가시성: 모델 비용은 구분 없는 하나의 토큰 합계가 아니라 키, 에이전트, 저장소, 개발자, 팀 또는 정책별로 귀속할 수 있어야 합니다.
- 정책 제어: 공급자 허용 목록, 승인 모델 목록, 예산, 데이터 보존 제어, 감사 로그가 있어야 팀 단위로 개인 실험을 넘어설 수 있습니다.
- 배포 부담: 관리형 게이트웨이는 운영을 대신하는 대가로 비용을 받습니다. 셀프 호스팅 게이트웨이는 플랫폼 요금을 없애는 대신 가용성, 업그레이드, 스토리지, 장애 대응을 구매자에게 돌려줍니다.
- 현재 가격: 모든 티어와 제한은 현재 공개된 공급자 페이지를 기준으로 했습니다. 모델과 공급자에 따라 달라지는 추론 가격은 순위에서 제외했고, 이 비교에서는 상위 모델 청구액을 일정하게 두었습니다.
Helicone도 검토했지만 순위에는 넣지 않았습니다. 게이트웨이 기능을 갖춘 강력한 관측성 제품이지만, 가장 뚜렷한 장점은 폭넓은 코딩 에이전트 설정보다 트레이싱과 분석에 있습니다. 범용 API 게이트웨이도 제외했습니다. HTTP 트래픽을 프록시할 수는 있지만, 코딩 에이전트에는 모델을 이해하는 폴백, 토큰 예산, 프롬프트·응답 제어, 여러 와이어 프로토콜과의 호환성이 필요합니다.
따라서 목록은 더 짧고 선택 기준은 더 명확합니다. 아래 제품마다 확실히 앞서는 용도가 있고, 그 경계를 넘으면 다른 제품이 더 나은 선택이 됩니다.
1. Vercel AI Gateway: 코딩 에이전트용 종합 최우수
Vercel AI Gateway는 그동안 개인별 코딩 에이전트 워크플로에서 게이트웨이 도입을 가로막던 설정 작업을 없애 주기 때문에 가장 무난한 기본 선택입니다. 현재 CLI는 키를 발급하고 설정 변경을 미리 보여준 뒤 vercel ai-gateway coding-agents setup 명령으로 지원 에이전트 아홉 개를 설정할 수 있습니다.

현재 지원 표에는 Claude Code, Cline, OpenAI Codex, Cursor, Hermes, Kilo Code, OpenClaw, OpenCode, Pi가 명시돼 있습니다. 그 밖의 툴을 위한 수동 설정 방법도 제공합니다. Claude Code, Codex, Cursor는 일반적인 OpenAI 인터페이스만으로 처리하기 어려운 와이어 동작 때문에 전용 호환 엔드포인트를 사용합니다. 구매 결정을 바꾸는 지점이 바로 여기입니다. 이제 게이트웨이는 직접 만든 애플리케이션 뒤에만 놓이는 인프라가 아니라, 엔지니어가 이미 쓰는 코딩 툴 뒤에도 둘 수 있습니다.
12명 규모의 제품 팀이라면 서로 다른 작업 방식에 하나의 예산과 하나의 폴백 정책을 적용할 수 있습니다. 한 엔지니어는 Claude Code를 계속 쓰고, 다른 엔지니어는 터미널에서 Codex를 실행하며, 또 다른 사람은 Cursor를 써도 됩니다. 회사가 편집기나 모델 회사 하나로 통일하지 않아도 모든 요청을 하나의 지출 화면에서 볼 수 있습니다.
추천 대상: 여러 코딩 에이전트를 사용하며 관리형 환경을 가장 빠르게 설정하려는 팀
핵심 강점: 지원 에이전트 아홉 개를 위한 하나의 CLI 워크플로와 Claude Code, Codex, Cursor 전용 엔드포인트
가격: 월 $5 무료 크레딧, 유료 추론은 토큰 마크업 없이 공급자 정가 적용
무료 체험: 기간 제한형 체험이 아니라 대상 모델에 계속 적용되는 무료 티어
기본 계층의 가격 구조는 이례적으로 단순합니다. Vercel의 현재 가격 페이지에 따르면 토큰에는 마크업도 플랫폼 수수료도 없습니다. 무료 티어는 월 $5 크레딧과 일부 대상 모델, 모델별로 더 낮은 한도를 제공합니다. 크레딧을 구매하면 계정이 Pay as you go로 전환되고 월 무료 크레딧은 종료됩니다. Bring Your Own Key는 유료 티어로 전환한 뒤에만 사용할 수 있으며, Vercel은 BYOK 수수료를 붙이지 않습니다.
주의할 점은 두 가지입니다. 첫째, 제로 마크업은 토큰 계층에만 해당하며 모든 제어 기능이 무료라는 뜻은 아닙니다. 팀 전체 공급자 허용 목록과 팀 전체 데이터 미보존은 각각 요청 1,000건당 $0.10입니다. 트레이스 드레인은 트레이스 1,000건당 $0.05에 송신 데이터 GB당 $0.50이 추가됩니다. 커스텀 리포팅은 쓰기와 쿼리 요금이 별도로 있습니다. 소규모 팀은 대부분 무시해도 되지만, 규제 대상 팀이라면 무료 게이트웨이라고 결론 내리기 전에 이 비용을 계산해야 합니다.
둘째, BYOK 요청이 실패하면 Vercel 시스템 자격 증명으로 재시도하고 폴백 사용량을 게이트웨이 크레딧 잔액에 청구할 수 있습니다. 합리적인 안정성 기본값이지만 예산 측면에서는 예외 상황입니다. 재무팀이 모든 요청이 기존 공급자 계약 안에서만 처리되리라 기대한다면 폴백 경로를 당연하게 여기지 말고 검토해야 합니다.
라우팅 제어 기능은 대부분의 제품 팀에 충분합니다. Vercel은 공급자 필터링과 순서 지정, 정렬, 자동 캐싱, 공급자 타임아웃, 모델 폴백을 문서화했습니다. 일반 코드 완성 트래픽은 선호 공급자로 보내고, 지연 시간이 허용치를 넘으면 빠르게 전환하며, 더 비싼 모델을 최종 복구 경로로 둘 수 있습니다.
가장 큰 한계는 배포 소유권입니다. Vercel AI Gateway는 관리형 서비스입니다. 게이트웨이 프로세스와 데이터베이스, 키, 로그를 자체 네트워크 안에서 실행해야 하는 팀에는 맞지 않습니다. 이 요구사항이 있다면 기능 비교를 시작하기도 전에 LiteLLM이 우선입니다.
- 코딩 에이전트 아홉 개를 위한 하나의 공식 설정 명령
- Claude Code, Codex, Cursor 전용 호환 엔드포인트
- 마크업과 토큰 플랫폼 수수료가 모두 없음
- 공급자 순서 지정, 타임아웃, 캐싱, 모델 폴백
- 200+개 모델의 청구서와 지출 화면을 하나로 통합
- 셀프 호스팅 게이트웨이 배포 불가
- BYOK는 유료 티어에서만 지원
- 고급 리포팅, 트레이스, 허용 목록, 팀 전체 ZDR에 별도 요금 부과
- CLI가 키를 발급한 뒤에도 Cursor 계정 설정에서 최종 작업 필요
프로젝트 규모로 키우지 않고 Vercel AI Gateway 설정하기
가장 안전한 설정 방법은 공급자 직접 연결로 되돌아갈 경로를 보존하고 저장소 하나부터 시작하는 것입니다. 모든 개발자와 에이전트를 한꺼번에 바꾸지 마십시오.
범위를 제한한 파일럿 키 만들기
파일럿 저장소 전용 게이트웨이 키 하나를 만들고 주간 또는 월간 지출 예산을 설정합니다. 코딩 에이전트 루프에는 별도의 중단 조건이 필요하므로 전사 애플리케이션 키를 재사용하지 않습니다.
공식 설정 명령 실행하기
vercel ai-gateway coding-agents setup을 실행합니다. CLI가 설치된 에이전트를 찾으면 파일럿에 포함할 툴만 고르고, 설정을 쓰기 전에 표시되는 변경 내용을 검토합니다.주 모델 하나와 폴백 하나만 두기
팀이 이미 신뢰하는 모델로 시작합니다. 툴 사용 동작이 비슷한 공급자 또는 모델 폴백 하나만 추가합니다. 라우팅 트리가 크면 실패 원인을 설명하기 어려워집니다.
요청 주체와 지출 라벨 확인하기
설정한 각 에이전트에서 범위가 작은 작업 하나씩 실행합니다. 대시보드가 에이전트, 모델, 공급자, 토큰 사용량, 비용, 지연 시간, 폴백 상태를 구매자가 기대한 방식으로 구분하는지 확인합니다.
직접 연결 경로 보존하기
기존 공급자 설정을 문서화된 롤백 파일에 보관합니다. 게이트웨이 때문에 툴 호출, 모델 탐색, 지연 시간이 달라지면 파일럿을 몇 분 안에 되돌릴 수 있어야 합니다.
2. Requesty: 브랜치·저장소·개발자별 비용 추적에 최적
Requesty는 엔지니어링 관리자가 모델 비용을 그 원인이 된 작업과 연결해야 할 때 가장 좋은 게이트웨이입니다. Claude Code 통합에서 요청에 브랜치, 저장소, 개발자, 에이전트 버전 태그를 붙일 수 있어 단순한 토큰 청구서를 팀이 조사할 수 있는 정보로 바꿔 줍니다.

마이그레이션과 기능 브랜치, 자동 리뷰를 동시에 돌리는 팀에는 낮은 수수료보다 이런 비용 귀속이 더 유용합니다. 예를 들어 B2B SaaS 팀은 백그라운드 리뷰 비용은 적지만 특정 저장소의 테스트·수정 루프가 월 지출 대부분을 차지한다는 사실을 발견할 수 있습니다. 그러면 모든 개발자의 사용 권한을 줄이는 대신 해당 저장소나 모델의 정책만 조정하면 됩니다.
추천 대상: 코딩 에이전트 비용을 브랜치·저장소·개발자별로 파악해야 하는 팀
핵심 강점: Claude Code 분석 태그, 라우팅 정책, EU 데이터 레지던시, MCP 게이트웨이
가격: 무료 모델은 $0, Pay as you go는 기본 모델 비용에 5% 추가, Enterprise는 맞춤 견적
무료 체험: 하루 200건, 카드가 필요 없는 무료 티어
Requesty의 현재 가격 페이지에는 20+개 공급자의 600+개 모델이 올라와 있습니다. Pay as you go에는 구독료와 좌석 요금, 최소 사용액이 없고 라우팅, 캐싱, 폴백, EU 데이터 레지던시에도 별도 요금이 없습니다. 공급자 정가 기준 월 추론 비용이 $2,000라면 5% 마크업은 $100입니다.
이 메타데이터로 더 큰 무통제 실행을 막거나 비용을 부서별로 배분할 수 있다면 $100은 충분히 정당화됩니다. 단지 다른 기본 URL이 필요한 개인 개발자에게는 설득력이 떨어집니다. OpenRouter는 더 넓은 카탈로그를 내세우고, Vercel은 지원 코딩 에이전트에 더 간결한 무마크업 경로를 제공합니다.
Requesty Enterprise 티어에는 SSO, RBAC, 감사 로그, 승인 모델 정책, PII 탐지, 그룹 예산, CI/CD용 서비스 계정, 맞춤 SLA가 추가됩니다. 대규모 엔지니어링 조직에도 충분히 고려할 만하지만 가격은 맞춤형입니다. 대표적인 요청 프로필과 견적 없이는 Enterprise를 비교할 수 없습니다.
문서 간 불일치도 알아둘 필요가 있습니다. 상용 가격 페이지에는 600+개 모델이라고 적혀 있지만, 2026년 8월 10일 수정된 Claude Code 통합 페이지에는 여전히 300+개 모델이라고 돼 있습니다. 유료 카탈로그에는 현재 판매 조건을 정하는 가격 페이지의 더 큰 수치를 적용했습니다. 어느 쪽의 홍보 문구도 보장으로 받아들이지 말고, 필요한 모델이 계정 라이브러리에 실제로 있는지 확인해야 합니다.
Claude Code 설정은 Vercel의 멀티 에이전트 CLI보다 범위가 좁지만 비용 귀속은 더 깊습니다. Requesty CLI는 Claude 설정을 쓰고 기존 파일을 백업할 수 있습니다. 선택형 셸 래퍼는 세션 시작 때 저장소, 브랜치, 사용자, 에이전트 버전 헤더를 주입합니다. 이 래퍼는 셸 설정에서 확인할 수 있고, 해당 헤더는 모델 공급자에게 전달되기 전에 제거됩니다.
한계는 비율 기반 과금입니다. 게이트웨이 제어 계층의 업무량이 늘지 않아도 5% 마크업은 모델 지출과 함께 커집니다. 월 $20,000이면 $1,000이 됩니다. 규모가 큰 구매자는 이 금액을 Portkey의 구독 모델, LiteLLM 운영비, Requesty Enterprise 맞춤 견적과 비교해야 합니다.
- 브랜치, 저장소, 개발자, 에이전트 버전별 비용 귀속
- 무료 모델에서 하루 200건 무료 요청
- Pay as you go에 라우팅, 캐싱, 폴백, 지출 상한, EU 데이터 레지던시 포함
- MCP 게이트웨이와 CI/CD용 서비스 계정 경로
- Pay as you go에 구독료, 좌석 요금, 최소 사용액 없음
- 추론 비용에 비례해 커지는 5% 마크업
- Enterprise는 견적 필요
- 여러 에이전트 설정의 통합 수준이 Vercel의 아홉 개 에이전트 CLI보다 낮음
- 현재 페이지마다 카탈로그가 300+개인지 600+개인지 다르게 표기
3. LiteLLM: 최고의 셀프 호스팅 게이트웨이
LiteLLM은 편의성보다 배포와 데이터에 대한 통제권이 중요할 때 가장 좋은 선택입니다. 오픈소스 프록시는 프로덕션에서도 무료로 셀프 호스팅할 수 있으며, 100+개 공급자를 하나의 OpenAI 호환 API 뒤에 연결합니다.

비공개 네트워크 경계를 둔 중견 기업 CTO에게 장점은 분명합니다. 모델 키, 요청 트래픽, 가상 키, 예산, 로그, Prometheus 메트릭이 회사가 운영하는 인프라 안에 남습니다. LiteLLM은 셀프 호스팅 제품에서 고객의 데이터나 트래픽을 볼 수 없다고 설명합니다. 모델 데이터 경로에서 관리형 게이트웨이 하나를 제거하는 셈입니다.
추천 대상: 셀프 호스팅 또는 에어갭 모델 접근이 필요한 플랫폼 팀
핵심 강점: 100+개 공급자, 가상 키, 예산, 폴백, Prometheus를 제공하는 무료 오픈소스 프록시
가격: 오픈소스 $0, Enterprise는 용량과 배포 방식에 따라 연간 맞춤 가격
무료 체험: 카드 없이 Enterprise 30일 체험, 오픈소스는 계속 무료
이번 비교에서 소프트웨어 가격은 가장 단순한 숫자이면서 가장 오해하기 쉽습니다. 오픈소스 게이트웨이는 프로덕션 사용을 포함해 $0입니다. 사용자와 팀, 지출 추적, 속도 제한, 요청·응답 로깅, LLM 폴백이 포함되고 토큰당 LiteLLM 라이선스 비용은 없습니다.
하지만 운영비까지 $0인 것은 아닙니다. 누군가는 프록시를 배포하고 데이터베이스와 시크릿을 관리하며, 규모를 조정하고 모니터링해야 합니다. 공급자가 API를 변경하면 업그레이드하고, 로그를 보존하고, 폴백을 테스트하며, 게이트웨이가 공용 장애 지점이 됐을 때 대응해야 합니다. LiteLLM은 공급자 청구서를 인프라 책임으로 바꿉니다. 플랫폼 팀에는 좋은 교환이지만 다섯 명 규모 스타트업에는 나쁜 교환일 수 있습니다.
Enterprise에는 SSO, SCIM, OIDC 또는 JWT 인증, 감사 로그, 시크릿 관리자 통합, 키 순환, 조직 제어, 멀티 리전 제어 영역, 지원, SLA, 에어갭 배포가 추가됩니다. 가격은 연간 계약이며 토큰이 아니라 요청 용량, 배포 아키텍처, 지원 수준에 따라 달라집니다. 이 경계가 중요합니다. 규제 대상 기업은 오픈소스로 시작해도 신원 관리, 감사, 상시 지원이 의무가 되는 순간 Enterprise가 필요할 수 있습니다.
구매자가 자주 혼동하는 두 가지 제품 인터페이스도 있습니다. Python SDK는 애플리케이션 라이브러리입니다. Proxy Server는 인증, 멀티테넌트 지출 관리, 가상 키, 관리자 대시보드를 갖춘 중앙 게이트웨이입니다. 공유 정책이 필요한 코딩 에이전트 도입이라면 몇몇 스크립트에 SDK만 추가할 것이 아니라 프록시를 평가해야 합니다.
코딩 에이전트 측 한계는 문서와 운영 소유권입니다. LiteLLM은 여러 에이전트가 사용할 수 있는 호환 엔드포인트를 제공하지만, Vercel처럼 현재 이름이 명시된 아홉 개 실행 환경을 한 번에 설치하는 도구는 없습니다. 에이전트마다 환경 변수, 응답 형식, 모델 탐색, 툴 사용 동작을 검증해야 합니다. Codex의 Responses API 동작과 Claude Code의 Anthropic 프로토콜은 각각 따로 파일럿 테스트할 필요가 있습니다.
- 프로덕션 셀프 호스팅에 쓸 수 있는 $0 오픈소스 라이선스
- 하나의 OpenAI 호환 API로 100+개 공급자 연결
- 가상 키, 예산, 속도 제한, 폴백, 로그, Prometheus 메트릭
- 고객이 운영하는 인프라 안에 트래픽과 키 유지
- 신원 관리, 감사, 에어갭, 지원, 멀티 리전 제어를 위한 Enterprise 경로
- 구매자가 가용성, 업그레이드, 스토리지, 확장, 장애 대응을 모두 담당
- Enterprise 가격 비공개
- 에이전트 실행 환경별 설정이 Vercel보다 덜 패키징됨
- 가볍게 배포한 중앙 프록시는 새로운 내부 장애 영역이 될 수 있음
4. OpenRouter: 폭넓은 모델 선택과 빠른 실험에 최적
OpenRouter는 하나의 계정으로 대규모 모델 시장을 비교하기에 가장 좋은 게이트웨이입니다. 현재 Pay as you go 페이지에는 80+개 공급자의 500+개 모델이 등록돼 있어 이번 후보 중 공개된 카탈로그가 가장 넓습니다.

이런 폭넓은 선택지는 개인 기술 개발자나 연구 비중이 높은 소규모 팀에 유용합니다. 공급자마다 결제 계정을 열지 않아도 코딩 에이전트로 저장소 계획에는 프런티어 모델, 검색과 분류에는 더 빠른 모델, 반복 변환에는 오픈 모델을 비교할 수 있습니다.
추천 대상: 빠른 모델 비교와 폭넓은 공급자 시장 접근
핵심 강점: 500+개 모델, 80+개 공급자, 작업을 인식하는 Auto Router
가격: 무료 $0, Pay as you go 플랫폼 수수료 5.5%, Enterprise 할인은 맞춤형
무료 체험: 25+개 모델, 4개 공급자, 하루 50건을 제공하는 무료 티어
상업적 대가는 명확합니다. OpenRouter의 Pay as you go 플랜은 최소 사용액이 없지만 플랫폼 수수료 5.5%를 부과합니다. 크레딧을 $2,000 구매하면 $110입니다. Bring Your Own Key는 현재 매월 정가 기준 추론 비용 $25,000까지 수수료 없이 허용하며, 그 이후에는 5%가 적용됩니다. Enterprise는 이 허용량을 $200,000로 높이고 견적에 따라 수수료를 할인합니다.
무료 플랜은 호환성을 확인하기에는 유용하지만 에이전트를 지속적으로 쓰기에는 부족합니다. 긴 코딩 루프 한 번에 하루 요청 쉰 건을 소진할 수 있습니다. 팀 예산이 아니라 연결 점검용으로 봐야 합니다.
OpenRouter의 Auto Router는 단순한 카탈로그 수보다 더 흥미로운 기능입니다. 현재 라우팅 문서에 따르면 코드 디버깅과 다단계 에이전트 계획을 포함해 프롬프트를 약 30가지 작업 유형으로 분류한 뒤, 최근 일주일간의 총지출을 활용해 모델 순위를 정합니다. 기능, 툴 지원, 비용, 계정 제한, 폴백 옵션도 함께 고려합니다.
이 시장 신호는 실험을 쉽게 하지만 재현은 어렵게 만듭니다. 라우터가 턴마다 다른 모델을 선택할 수 있기 때문입니다. 세션 고정 기능은 이전 모델이 계속 상위 후보일 때 이를 우선하지만, 작업이 바뀌면 선택도 달라질 수 있습니다. 여러 턴에 걸쳐 패치를 만드는 코딩 에이전트에서는 세션 중간의 모델 변경이 툴 문법, 추론 방식, 출력 규율에 영향을 줄 수 있습니다.
해법은 라우팅 자체를 피하는 것이 아니라 동적 라우팅을 어디에 쓸지 정하는 것입니다. 평가, 위험이 낮은 분류, 범위가 제한된 백그라운드 단계에 활용합니다. 릴리스에 중요한 패치는 팀이 모델 간 연속성을 검증하기 전까지 승인된 모델과 공급자 정책으로 고정하는 편이 낫습니다.
OpenRouter는 여러 공급자에 걸친 정책 기반 라우팅과 폴백도 제공합니다. 같은 모델을 여러 추론 호스트가 판매할 때 유용합니다. 하지만 저장소별 비용 배분이나 셀프 호스팅 제어, 관리형 엔터프라이즈 가드레일이 필요할 때는 강점이 줄어듭니다. 각각의 요구에는 Requesty, LiteLLM, Portkey가 더 낫습니다.
- 이번 후보 중 가장 큰 500+개 모델·80+개 공급자 카탈로그
- 공급자별 계정 없이 빠르게 모델 비교 가능
- 현재 작업과 시장 신호를 활용하는 Auto Router
- 공급자 폴백, 지출 제어, 정책 기반 라우팅
- 호환성 확인에 쓸 수 있는 무료 플랜
- 지출에 비례해 커지는 Pay as you go 수수료 5.5%
- 무료 플랜의 하루 50건은 지속적인 에이전트 루프에 부족
- 동적 라우팅으로 턴 사이에 모델이 바뀔 수 있음
- 상위 두 제품보다 에이전트 실행 환경별 설정과 저장소 비용 귀속이 약함
5. Portkey: 최고의 관리형 거버넌스 계층
Portkey는 단일 엔드포인트가 아니라 관리형 제어 영역이 예산을 받은 요구사항일 때 가장 좋은 선택입니다. 이 게이트웨이는 폴백, 조건부 라우팅, 재시도, 서킷 브레이커, 부하 분산, 카나리 테스트, MCP 지원, 예산, 속도 제한, 캐시, 가드레일을 한데 묶습니다.

이 기능 구성은 개별 에이전트 키에서 승인된 접근 체계로 넘어가는 중견 플랫폼 팀에 잘 맞습니다. 하나의 정책으로 모델을 제한하고, 하나의 예산으로 팀 지출을 막으며, 하나의 서킷 브레이커로 장애가 난 공급자에 반복 호출하는 일을 중단할 수 있습니다. ‘개발자에게 게이트웨이 키를 주자’는 결정이 신원, 정책, 장애 관리 문제로 커지는 시점을 겨냥한 제품입니다.
추천 대상: 성장하는 플랫폼 팀의 관리형 라우팅, 가드레일, 거버넌스
핵심 강점: 서킷 브레이커, 카나리 테스트, MCP 제어, 조건부 라우팅, 오픈소스 로컬 게이트웨이
가격: Developer $0, Production 월 $49, 맞춤형 Enterprise
무료 체험: Developer 플랜은 계속 무료지만 프로덕션에는 명시적으로 부적합
플랜 경계가 유난히 솔직합니다. Portkey의 Developer 플랜은 월 10,000건의 로그를 기록하고 로그는 사흘, 메트릭은 30일 동안 보관합니다. 가격 페이지에 프로덕션용으로 적합하지 않다고 명시돼 있습니다.
Production은 월 $49이며 로그 100,000건을 기록합니다. 공개된 한도까지 요청 100,000건이 추가될 때마다 $9가 부과됩니다. 로그는 30일, 메트릭은 90일 동안 보관합니다. 기록 로그가 200,000건이면 상위 추론 비용을 제외한 구독료는 $58입니다. 같은 페이지에는 맞춤형 보안 제어나 데이터 레지던시 보장이 필요할 때 Production을 권장하지 않는다고 적혀 있습니다.
이 요구사항에는 Enterprise 티어가 필요합니다. 가격은 맞춤형이며 10 million+건의 기록 로그, 맞춤 보존 기간, SSO, 세분화된 예산과 속도 제한, 프라이빗 클라우드·VPC 호스팅, 데이터 레이크 내보내기, 고급 규정 준수를 추가합니다. $49 카드 결제에서 조달 절차로 넘어가는 의미 있는 변화입니다.
Portkey는 npx @portkey-ai/gateway로 실행하는 오픈소스 로컬 게이트웨이도 공개합니다. 라우팅 인터페이스를 시험하거나 데이터 경로를 셀프 호스팅할 수 있습니다. 다만 로컬 게이트웨이와, Portkey가 이번 순위에 오른 이유인 관리형 관측성·정책·지원·Enterprise 제어를 구분해서 봐야 합니다.
현재 진행 중인 제품 전환도 확인할 사안입니다. Portkey 문서에는 이제 Prisma AIRS AI Gateway라고 쓰여 있습니다. 게이트웨이 페이지와 가격은 계속 공개돼 있지만, 구매자는 계약서에 어떤 제품명이 들어가는지, 어느 로드맵이 적용되는지, 독립형 Portkey 계정이 Palo Alto Networks 포트폴리오와 어떻게 연결되는지 물어봐야 합니다. 구매 검토에 필요한 사항이지 제품을 배제할 이유는 아닙니다.
코딩 에이전트 측 한계는 설정입니다. Portkey는 호환되는 에이전트 프로토콜 뒤에 둘 수 있고 Vercel보다 깊이 있는 범용 제어 영역을 제공합니다. 하지만 현재 명령 하나로 아홉 개 실행 환경을 설정하는 경험은 제공하지 않습니다. 기능 목록이 길어서가 아니라 정책에 통합 작업만큼의 가치가 있을 때 선택해야 합니다.
- 서킷 브레이커, 재시도, 폴백, 카나리 테스트를 갖춘 풍부한 관리형 라우팅
- MCP 지원, 가드레일, 예산, 속도 제한
- 기록 로그 기준이 명확한 공개형 월 $49 Production 티어
- 오픈소스 로컬 게이트웨이 옵션
- SSO, 프라이빗 배포, 레지던시, 규정 준수를 위한 Enterprise 경로
- 무료 플랜은 프로덕션에 부적합하다고 명시
- $49 Production은 맞춤형 보안이나 레지던시 보장을 위한 티어가 아니라고 명시
- Enterprise 가격은 맞춤형
- 코딩 에이전트 설정이 Vercel보다 덜 패키징됨
- Prisma AIRS 전환으로 계약과 로드맵 확인 필요
6. Cloudflare AI Gateway: 이미 Workers를 쓰는 팀에 최적
Cloudflare AI Gateway는 애플리케이션의 엣지와 로그, 보안을 이미 Cloudflare가 담당하고 있을 때 가장 부담 없이 선택할 수 있는 제품입니다. 분석, 캐싱, 속도 제한을 포함한 핵심 게이트웨이 기능은 현재 모든 플랜에서 무료입니다.

에이전트나 사내 개발자 플랫폼이 이미 Workers에서 실행되는 팀에는 매력적입니다. 같은 계정으로 OpenAI 호환 REST 인터페이스를 통해 타사 모델과 Cloudflare 호스팅 모델을 호출하고, 비용과 오류를 기록하고, 안전하게 반복되는 요청을 캐시하고, 속도 제한을 적용하고, 민감 데이터를 검사하고, 실패한 호출을 재시도할 수 있습니다.
추천 대상: 이미 Workers, Cloudflare 로그 또는 Cloudflare 보안 제어를 사용하는 팀
핵심 강점: 무료 핵심 게이트웨이, 엣지 통합, DLP, 캐싱, OpenAI 호환 타사 모델 접근
가격: 핵심 기능 $0, Unified Billing 크레딧 구매 수수료 5%, 가드레일에는 Workers AI 가격 적용
무료 체험: 기간 제한 없이 핵심 게이트웨이 기능 무료
가격 페이지는 무료 제공 범위를 구체적으로 밝힙니다. Workers Free는 모든 게이트웨이를 합쳐 총 100,000건의 로그를 저장합니다. Workers Paid는 게이트웨이마다 10 million건을 저장합니다. 모든 플랜에서 영구 로그, 분석, 캐싱, 속도 제한을 사용할 수 있습니다.
Cloudflare를 통해 크레딧을 구매하는 Unified Billing에는 5% 수수료가 붙습니다. 따라서 $2,000의 크레딧을 사려면 $2,100이 들지만 공급자 추론 자체에는 여전히 마크업이 없습니다. 모델 가격은 같아도 자격 증명과 결제를 통합하는 데 수수료가 든다는 차이를 알아야 합니다.
Data Loss Prevention 검사는 모든 플랜에서 무료입니다. Zero Trust 구독이 없는 계정에는 사전 정의된 DLP 프로필 두 개가 제공되며, 더 다양한 프로필은 Cloudflare One 구독에 따라 달라집니다. 가드레일은 무료 핵심 기능에 포함되지 않습니다. Cloudflare는 프롬프트와 응답 평가를 Workers AI 토큰 추론으로 과금합니다.
Cloudflare는 유용한 요청 제어 기능도 제공합니다. REST 문서에 요청별 타임아웃과 재시도 방식, 최대 다섯 번의 시도, 최대 5,000밀리초의 재시도 지연이 명시돼 있습니다. 느린 공급자가 에이전트 루프를 끝없이 붙잡는 상황을 막을 수 있습니다.
한계는 코딩 에이전트 설정 편의성입니다. Cloudflare는 애플리케이션이 게이트웨이를 호출하는 방법을 설명하지만, Vercel이나 Requesty의 Claude Code 워크플로처럼 이름이 지정된 에이전트 설정 계층은 제공하지 않습니다. 개발자는 실행 환경마다 기본 URL, 인증, 모델 탐색, 프로토콜을 어떻게 바꿀지 확인해야 합니다. 소프트웨어 비용이 $0이어도 통합 비용은 엔지니어링 팀이 부담할 수 있습니다.
- 핵심 분석, 캐싱, 속도 제한 무료
- OpenAI 호환 방식으로 Cloudflare 및 타사 모델 접근
- 모든 플랜에서 DLP 검사 무료
- Workers, Cloudflare 로그, 보안 제품과 뛰어난 궁합
- 명시적인 재시도와 타임아웃 제어
- Unified Billing 크레딧 구매에 5% 추가
- 무료 로그 저장량은 계정 전체 100,000건에서 중단
- 가드레일에 별도 Workers AI 추론 비용 발생
- 유사한 명령 하나짜리 코딩 에이전트 설정 없음
- 전체 DLP 프로필에는 별도의 Zero Trust 구독이 필요할 수 있음
팀별 추천 AI 게이트웨이는?
가장 좋은 게이트웨이는 더 큰 운영 부담을 만들지 않으면서 팀이 지금 겪는 조정 비용을 없애는 제품입니다. 타협할 수 없는 조건부터 정한 다음 요금을 비교하십시오.
Claude Code, Codex, Cursor, OpenCode와 관련 에이전트를 함께 쓰는 팀에는 Vercel AI Gateway가 적합합니다. 셀프 호스팅이 의무이거나 비용을 에이전트·키·모델 수준이 아니라 저장소와 개발자까지 연결해야 한다면 다른 제품을 선택합니다.
브랜치와 저장소, 개발자별 비용 귀속이 필요한 에이전시, 컨설팅사, 제품 조직에는 Requesty가 맞습니다. 이 메타데이터가 실제 예산 결정을 바꾸지 못한다면 5% 마크업으로 아무도 쓰지 않는 정보를 사는 셈이므로 선택이 달라집니다.
컨테이너, 데이터베이스, 시크릿, 로깅, 당직 체계가 이미 갖춰진 플랫폼 팀에는 LiteLLM이 적합합니다. 제품 엔지니어 한 명이 프록시를 비공식적으로 떠맡게 된다면 관리형 게이트웨이가 더 낫습니다.
개인 개발자나 연구팀이 아직 모델과 공급자를 비교하는 단계라면 OpenRouter를 선택합니다. 후보가 소수로 굳어지고 반복되는 5.5% 수수료가 넓은 카탈로그의 가치보다 커지면 선택도 바뀝니다.
승인 모델, 가드레일, 서킷 브레이커, 카나리 테스트, 관리형 거버넌스가 구매 이유라면 Portkey가 적합합니다. 엔드포인트 하나와 지출 대시보드만 필요하다면 다른 선택이 더 단순합니다.
이미 Workers와 Cloudflare 보안을 구매해 익숙하게 운영하고 있다면 Cloudflare AI Gateway가 맞습니다. 주변 플랫폼을 새로 도입하는 통합 작업이 게이트웨이가 줄여 주는 일보다 많다면 선택하지 않습니다.

한 가지 원칙이 더 있습니다. 게이트웨이 선택과 에이전트 실행 환경 선택을 분리해야 합니다. Claude Code, Codex, Cursor는 서로 다른 엔지니어링 업무를 해결하고, 게이트웨이는 이들의 모델 트래픽을 통제합니다. 편집기를 통일하지 않고 게이트웨이만 표준화할 수 있으며, 실제로 이쪽이 더 유용한 제어 경계인 경우가 많습니다.
더 폭넓은 에이전트 후보는 최고의 AI 코딩 에이전트에서 비교할 수 있습니다. 게이트웨이를 넘어 SSO, 보존, 감사, 배포에 관한 질문은 기업용 코딩 에이전트 비교를 참고하십시오.
이 용도라면 피해야 할 선택
당장 해결할 문제가 코딩 에이전트 설정이라면 Helicone을 첫 구매 대상으로 삼지 마십시오. Helicone의 Hobby 티어는 요청 10,000건까지 무료이고 Pro는 월 $79, Team은 월 $799입니다. 관측성, 세션, 프롬프트, 분석 기능은 유용할 수 있습니다. 하지만 가시성이 핵심 문제일 때만 순위가 달라집니다. 이 검색 의도에서는 Vercel의 현재 설정 경로, Requesty의 저장소 비용 귀속, LiteLLM의 배포 통제보다 낫지 않습니다.
회사가 이미 보유했다는 이유만으로 범용 API 게이트웨이를 고르는 것도 피해야 합니다. 전통적인 게이트웨이는 경로, 인증, HTTP 정책을 이해합니다. 코딩 에이전트 트래픽에는 공급자별 모델, 토큰 계산, 툴 사용 호환성, 프롬프트 캐싱, 모델 폴백, 여러 응답 프로토콜이 더해집니다. 플랫폼 팀이라면 범용 게이트웨이를 확장하는 선택도 가능하지만, “이미 Kong이 있다”는 말만으로 구현 계획이 되지는 않습니다.
여러 에이전트가 의존하게 된 뒤에도 직접 만든 패스스루 프록시를 유지하는 선택은 피해야 합니다. 기본 URL을 바꾸는 일은 쉽습니다. 공급자 어댑터, 안전한 재시도, 스트리밍 응답, 예산 카운터, 키 격리, 로그 보존, 모델 지원 중단을 관리하는 일은 하나의 제품을 운영하는 것과 같습니다. 고유한 정책이나 배포 제약이 영구적인 운영 책임을 정당화할 때만 직접 만드십시오.
모델 간 연속성을 평가하기 전에는 릴리스에 중요한 에이전트 루프의 모든 단계에 동적 모델 라우팅을 적용하지 마십시오. 라우터가 작업마다 효율적인 모델을 골라도 긴 패치의 재현성이 떨어질 수 있습니다. 실제 변경을 만드는 단계에는 모델을 고정하고, 범위가 제한된 보조 작업에 동적 라우팅을 사용합니다.
마지막으로 첫날부터 모든 개발자의 트래픽을 라우팅하지 마십시오. 코딩 에이전트 인터페이스는 그대로 보여도 게이트웨이가 인증, 모델 탐색, 캐싱, 오류 처리, 폴백 선택을 바꿀 수 있습니다. 그래서 범위를 제한한 파일럿과 공급자 직접 연결로 돌아갈 경로가 배포 계획에 반드시 들어가야 합니다.
자주 묻는 질문
가장 좋은 LLM 게이트웨이는 무엇인가요?
코딩 에이전트의 기본 선택으로는 Vercel AI Gateway가 가장 좋습니다. 지원 에이전트 아홉 개를 명령 하나로 설정하면서 토큰 마크업이 없기 때문입니다. 셀프 호스팅이 필수라면 LiteLLM, 저장소·개발자별 비용 귀속이 가장 중요하면 Requesty, 관리형 거버넌스가 구매 이유라면 Portkey가 더 낫습니다.
2026년 OpenRouter 가격과 수수료는 얼마인가요?
OpenRouter의 현재 Pay as you go 플랜은 플랫폼 수수료 5.5%이며, 80+개 공급자의 500+개 모델을 제공하고 최소 사용액은 없습니다. 무료 티어는 25+개 무료 모델, 4개 공급자, 하루 50건으로 제한됩니다. 현재 Pay as you go의 BYOK 허용량은 매월 정가 기준 추론 비용 $25,000이며, 이를 넘으면 5% 수수료가 적용됩니다.
2026년 Cloudflare AI Gateway 비용은 얼마인가요?
Cloudflare AI Gateway의 핵심 기능은 무료입니다. Unified Billing 크레딧 구매에는 5%가 추가되고, Workers Free는 계정 전체에 로그 100,000건, Workers Paid는 게이트웨이마다 로그 10 million건을 저장합니다. 가드레일은 Workers AI 추론 비용으로 별도 과금됩니다.
하나의 게이트웨이로 Claude Code와 Codex를 모두 라우팅할 수 있나요?
가능합니다. 게이트웨이가 각 에이전트 실행 환경이 요구하는 프로토콜을 지원하거나 전용 호환 엔드포인트를 제공해야 합니다. Vercel은 Claude Code와 Codex 엔드포인트를 별도로 문서화했지만, 셀프 호스팅 및 범용 게이트웨이는 구매자가 각 실행 환경의 설정을 직접 검증해야 합니다.
월요일부터 실행할 코딩 에이전트 게이트웨이 도입안
월요일부터 회사 전체를 마이그레이션하지 마십시오. 대표 저장소 하나에서 게이트웨이 하나가 비용의 불투명성과 공급자 위험을 줄일 수 있는지 입증하는 데 시간을 쓰는 편이 낫습니다.
월요일: 제어 경계 정하기
저장소 하나, 소규모 개발자 그룹 하나, 이들이 이미 쓰는 코딩 에이전트 두 개를 고릅니다. 결제를 정당화하는 이유를 한 문장으로 씁니다. 결제 통합, 공급자 실패 복구, 비용 귀속, 승인 모델 강제, 프라이빗 배포 내 트래픽 유지 중 하나여야 합니다. 문장에 서로 무관한 목표가 세 개 들어간다면 파일럿 범위를 좁힙니다.
지출 상한을 강제로 적용한 전용 게이트웨이 키를 만듭니다. 툴 사용 지원이 비슷한 주 모델 하나와 폴백 하나를 고릅니다. 트래픽을 옮기기 전에 공급자 직접 연결 설정을 롤백 파일에 보존하고 현재 공급자 청구액을 기록합니다.
화요일: 연결한 뒤 변경 내용 확인하기
Vercel은 공식 설정 명령을 실행하고 실제로 쓰기 전에 모든 변경 내용을 검토합니다. Requesty는 Claude Code 설정을 백업하고 팀이 실제로 쓸 비용 귀속 헤더만 활성화합니다. LiteLLM은 노트북이 아니라 표준 인프라 경로로 프록시를 배포합니다. 어떤 게이트웨이든 시크릿이 승인된 저장소에 들어갔는지 확인합니다.
각 에이전트에서 범위가 제한된 이슈 하나를 실행합니다. 모델 선택, 툴 호출, 스트리밍, 오류, 캐시 동작, 비용, 요청에 붙은 주체 정보를 확인합니다. 응답에 성공했더라도 대시보드에서 누가 비용을 썼는지, 어느 폴백이 응답했는지 설명할 수 없다면 충분하지 않습니다.
수요일과 목요일: 실패 경로 강제로 시험하기
통제된 타임아웃을 일으키거나 주 공급자를 사용할 수 없는 곳으로 보내는 테스트 경로를 사용합니다. 폴백이 코딩 에이전트가 기대하는 와이어 형식을 유지하는지 확인합니다. 실패한 시도에도 비용이 청구되는지, 폴백이 다른 자격 증명을 쓰는지, 트레이스에 두 시도가 모두 구분되는지도 살펴봅니다.
파일럿에 일상적인 버그 하나, 여러 파일을 바꾸는 작업 하나, 테스트·수정 루프 하나, 리뷰 작업 하나를 맡깁니다. 완료된 작업의 비용, 공급자 실패, 복구된 요청, 설정 변경에 쓴 시간, 개발자가 보고한 불편을 기록합니다. 실제 작업 결과 없이 프롬프트 수만 비교해서는 안 됩니다.
금요일: 실제 결정을 바꾼 제어 기능 구매하기
게이트웨이가 제공하는 정보나 안정성이 운영 결정을 바꿀 때만 도입합니다. 복구된 요청은 가치가 있습니다. 저장소의 예산 초과도, 공급자 정책 위반도 중요한 정보입니다. 담당자가 아무도 보지 않는 토큰 차트로 가득한 대시보드는 그렇지 않습니다.
여러 에이전트를 함께 쓰는 대부분의 팀이라면 월요일의 첫 선택은 파일럿 키 하나, 주 모델 하나, 폴백 하나를 둔 Vercel AI Gateway입니다. 정책이 요구하기 전에는 유료 부가 기능을 쓰지 않습니다. 비용 책임을 저장소와 개발자 수준까지 내려야 하면 Requesty로, 데이터 경로를 회사 인프라 안에 둬야 하면 LiteLLM으로 선택이 바뀝니다.
게이트웨이 설정은 버전 관리하고, 롤백 경로는 문서화하며, 모델 정책은 작게 유지합니다. 목적은 더 많은 공급자를 거치는 데 있지 않습니다. 다음 공급자 장애와 모델 출시, 예산 검토를 회사 전체 마이그레이션이 아니라 설정 변경으로 처리하는 것이 핵심입니다.
2026년 9월 3일







