OpenRouter 가격: Jev Router는 정말 무료일까?
OpenRouter 가격표에는 Jev Router가 $0로 표시됩니다. 하지만 선택된 모델과 추론 비용까지 정말 무료일까요? 응답의 usage.cost와 생성 기록, 캐시·툴 비용을 대조해 실제 세션 비용을 확인하는 방법과 도입 전 4개 요청 검증 절차를 정리했습니다.

Jev Router는 무료일까요? OpenRouter 가격 페이지에는 입력 토큰과 출력 토큰이 모두 $0로 표시되지만, 이것만으로 라우팅된 에이전트 세션의 총비용이 $0라고 단정할 수는 없습니다. 관리형 엔드포인트가 다른 모델과 추론 강도를 선택하므로, 예산을 확정하려면 응답의 usage.cost를 생성 기록과 대조해야 합니다.
OpenRouter의 관리형 typesafe/jev-router 엔드포인트인 Jev Router는 2026년 9월 25일 출시됐습니다. 대화의 매 턴마다 어떤 모델이 답할지 선택하는 채팅 엔드포인트입니다. 원래의 Jev 의사결정 모델이나 이름이 비슷한 오픈 소스 CLI 래퍼와는 다른 제품입니다.

OpenRouter 가격으로 확인한 Jev Router 무료 여부
확인된 답은 초록색 “무료” 배지가 암시하는 것보다 범위가 좁습니다. Jev Router의 입력 토큰과 출력 토큰 가격은 모두 $0로 안내되지만, 라우터가 선택한 모델까지 포함한 총비용에 관한 설명이 충분히 명확하지 않아 모든 라우팅 세션이 무료라고 단정할 수는 없습니다.
Jev Router 실시간 페이지는 2026년 9월 26일 확인했습니다. FAQ에는 라우터가 무료이며 입력 토큰과 출력 토큰에 요금이 부과되지 않는다고 적혀 있습니다. 또한 대화가 달라질 때마다 하나의 엔드포인트가 모델과 추론 강도를 선택하며, 컨텍스트 창은 1,000,000 토큰이라고 설명합니다.
다만 카탈로그의 두 가지 정보 때문에 더 강하게 결론 내리기는 어렵습니다. 같은 날 OpenRouter의 공개 Models API는 라우터의 입력·출력 가격에 일반적인 고정 숫자 대신 -1을 반환했습니다. 엔드포인트 레코드에는 제공업체 엔드포인트가 없었습니다. 이 기계 판독 필드가 과금을 입증하는 것은 아니지만, 페이지의 $0 표시를 세션별 명세서로 바꿔 주지도 않습니다.
이 글을 발행한 환경에는 인증된 OpenRouter API 키나 로그인된 OpenRouter 세션이 없었기 때문에, 과금 가능한 요청을 보내지 않았습니다. 따라서 이 결론을 뒷받침하는 실제 usage.cost나 Activity 기록은 없습니다. 예산을 안전하게 잡으려면 $0를 공개된 엔드포인트 가격으로 받아들이되, 고객이나 재무팀에 추론이 무료라고 약속하기 전에 전체 호출 비용을 확인해야 합니다.
9월 25일, 무엇이 달라졌나
변화의 핵심은 Jev가 라우터를 구축할 때 쓰는 구성 요소에서, 관리형 채팅 엔드포인트 안에서 직접 작동하는 의사결정 계층으로 바뀌었다는 점입니다.
Jev 1.13은 산문이 아니라 제한된 형식의 결정을 반환하는 System One 모델입니다. 애플리케이션이 상태를 전달하고 타입이 지정된 Choice, Score 또는 예/아니요 형식의 Noul 질문을 보냅니다. 모델이 “강력한 티어를 사용하라”고 결정할 수는 있지만, 실제로 해당 티어를 호출하고 대화를 유지하며 두 요청의 비용을 계산하는 일은 여전히 코드가 맡아야 합니다.
관리형 라우터는 이 과정을 typesafe/jev-router 하나로 합칩니다. OpenRouter의 출시 스레드에 따르면, Jev는 매 턴을 처리하기 전에 프롬프트의 난도와 정밀도를 평가하고 더 큰 모델이나 더 많은 추론이 필요한지, 과제가 달라졌는지를 살핍니다. 그런 다음 OpenRouter가 선택된 모델로 해당 턴을 보내고 생성된 텍스트를 반환합니다.
오픈 소스 gargpratyush/jev-router는 특히 새 엔드포인트와 혼동하기 쉽습니다. 이 프로젝트는 실제 Claude Code 또는 Codex CLI를 실행하고, 새로운 턴마다 Jev로 한 차례 결정한 뒤 그 결과를 계정별 티어에 매핑하며 CLI의 기존 인증을 그대로 전달합니다. 관리형 OpenRouter 모델 슬러그가 아니며, 과금 경로도 다릅니다.
이 차이는 구현 방식까지 바꿉니다. 기존 Jev 워크플로는 의사결정에 쓰는 기본 요소를 제공합니다. DIY 라우터는 코딩 구독을 활용하는 로컬 정책을 제공합니다. 관리형 엔드포인트에서는 한 번의 API 호출로 라우터가 고른 모델의 답을 받습니다.
Jev Router는 대화를 어떻게 처리하나
Jev Router는 다음 메시지가 달라 보인다는 이유만으로 모델을 바꾸지 않도록 설계됐습니다. 모델을 전환하면 제공업체에 캐시된 대화를 잃고 새 모델이 전체 기록을 다시 읽어야 할 수 있기 때문에 중요합니다.
OpenRouter에 따르면, 라우터는 세션의 나머지 구간에서도 잘 작동하는 모델을 유지하고, 모델을 바꾸지 않은 채 추론 강도를 높이거나 낮출 수 있습니다. 모델을 바꿨을 때 기대되는 개선 효과가 잃게 될 캐시 비용보다 클 때만 전환합니다. 이 판단을 위해 대화 텍스트를 읽습니다. 출시 스레드에는 첨부 파일이 Jev로 전송되지 않으며 zdr: true 요청도 지원된다고 나옵니다.

이는 단순한 프롬프트별 분류가 아닙니다. 쉬운 후속 질문에서는 모델을 바꾸는 것보다 캐시를 유지하는 편이 더 가치 있을 수 있어 저렴한 모델을 계속 쓸 수 있습니다. 어려운 턴에는 대화 전체를 다른 모델로 옮겨 컨텍스트를 다시 처리하는 비용을 내지 않고도 추론 강도를 높일 수 있습니다. 과제가 실제로 달라지면 라우터가 모델을 바꿀 수 있습니다.
운영 환경에는 분명한 한계도 있습니다. Jev의 결정이 시간 초과되거나 유효하지 않은 출력을 반환하면 OpenRouter는 다른 라우터로 대체하지 않고 요청을 실패 처리한다고 설명합니다. 반면 별도의 DIY 프로젝트는 fail-open 방식으로 현재 모델이나 대체 모델을 계속 사용합니다. 따라서 관리형 엔드포인트를 선택한다는 것은 단순히 가격 최적화 도구를 하나 더하는 것이 아니라 핵심 경로에 새로운 의존성을 받아들이는 일입니다.
$0 표시에 포함되는 범위와 입증하지 못하는 것
$0 표시는 OpenRouter가 공개한 범위, 즉 Jev Router 페이지의 입력 토큰과 출력 토큰 가격만을 가리킵니다. 선택된 유료 모델, 추론 토큰, 캐시 읽기, 툴, 크레딧 충전 비용이 그 숫자 안에서 어떻게 정산되는지 항목별로 설명하지는 않습니다.
OpenRouter의 일반 과금 규칙에 따르면 보통의 요청에는 선택된 모델과 제공업체의 요율이 적용됩니다. 새 Jev 페이지에는 라우터가 무료라고 나옵니다. 그러나 관리형 엔드포인트가 선택된 모델의 추론 비용을 한시적으로 지원하는지, 별도 항목으로 청구하는지, 출시 전용 방식을 적용하는지는 어느 출처에도 명시돼 있지 않습니다. 일반 Auto Router 규칙을 그대로 적용하는 것도 추정이며, 유료 모델의 추론까지 전부 무료라고 선언하는 것 역시 추정입니다.
첫 번째 기준은 응답입니다. OpenRouter의 사용량 계산 문서에 따르면 모든 응답에는 입력, 출력, 추론, 캐시 토큰과 비용 정보가 포함됩니다. usage.cost는 계정에 청구된 총액입니다. 응답의 model 필드에서 어떤 모델이 답했는지 확인할 수 있습니다.
두 번째 기준은 생성 기록입니다. OpenRouter Logs에는 모델, 제공업체, 비용, 토큰 수, 지연 시간, 캐시 할인, BYOK 비용과 웹 검색·웹 가져오기·파일 처리 요금이 표시됩니다. 종합 Activity 대시보드에서는 지출, 요청, 토큰 유형, 캐시 적중률을 확인하고 모델, 제공업체, 키, 앱, 사용자별로 필터링할 수 있습니다.
논쟁이 될 만한 각 비용 항목은 다음처럼 확인하면 됩니다.
- 선택된 모델: 반환된
model을usage.cost및 생성 기록의total_cost와 비교합니다. - 추론:
completion_tokens_details.reasoning_tokens와 해당 턴의 라우팅 설명을 저장합니다. - 캐시 재사용:
prompt_tokens_details.cached_tokens를 저장한 뒤 생성 상세 정보에서 캐시 할인이 있는지 확인합니다. - 툴: 기준 테스트에서는 제외하고, 운영 환경에서 활성화하기 전에 별도의 생성 비용 항목을 확인합니다.
- 크레딧 수수료: 구매 수수료는 따로 배분합니다. OpenRouter의 현재 FAQ에는 카드로 충전한 크레딧은 5.5%, 최저 $0.80, 암호화폐는 5%라고 적혀 있습니다. 이는 충전 수수료이지 Jev Router의 추가 요금 근거가 아닙니다.

수치로 보면 무료 라우팅 결정과 무료 세션은 다르다
라우팅 결정 비용 자체는 이미 매우 작습니다. 경제성을 좌우하는 더 큰 질문은 Jev가 적절한 모델을 고르고, 유용한 캐시를 보존하며, 실제로 채택할 만한 결과를 만들어 내는지입니다.
먼저 기존의 명시적 의사결정 방식을 보겠습니다. Jev 1.13의 가격은 입력 토큰 100만 개당 $0.042, 출력 토큰 100만 개당 $0입니다. 각 라우팅 결정에 입력 토큰 500개가 들고 총 100,000턴을 처리한다고 가정하겠습니다. Jev 입력 토큰은 5,000만 개, 즉 의사결정 계층 비용은 $2.10입니다. 각 턴에 답하는 생성 모델의 비용은 별도로 더해집니다.
관리형 페이지에 표시된 요율을 적용하면 같은 라우터 항목은 $0입니다. 따라서 이 워크로드에서 겉으로 보이는 절감액은 결정 100,000회당 $2.10입니다. 의미 있는 절감이지만, 제품 선택의 유일한 근거로 삼기에는 부족합니다. 잘못된 모델 전환 한 번의 영향이 Jev 결정 수천 번보다 클 수 있습니다.
이전 프롬프트 토큰이 20,000개 쌓인 대화를 예로 들어 보겠습니다. 선택된 모델의 입력 요율을 토큰 100만 개당 $2로 가정하면, 새 모델이 해당 기록을 다시 읽는 데 캐시 할인이나 새 출력 비용을 반영하기 전 기준으로 $0.04가 듭니다. 불필요한 전환 53번이면 $2.12로, 앞서 든 100,000턴 예시의 Jev 1.13 의사결정 비용 전체보다 조금 많습니다.
세션을 이해하는 라우터의 지속 가능한 비용 이점은 바로 여기에 있습니다. 라우팅 분류기를 무료로 만드는 것보다 올바른 캐시를 보존하는 편이 더 중요할 수 있습니다. 이 계산은 명시적인 가정에 따른 시나리오이며, Jev Router가 $2 모델을 선택하거나 53번의 전환을 피한다는 주장이 아닙니다.
성능 근거는 유망하지만 아직 충분하지 않습니다. OpenRouter는 네 가지 에이전트 벤치마크에서 Jev Router가 총 423개 과제 중 237개를 해결해, 130개에 그친 Auto Router보다 82% 더 많았다고 보고했습니다. 또한 다섯 가지 에이전트 벤치마크에서 테스트한 다른 모든 라우터보다 첫 토큰까지 걸린 시간의 중앙값이 더 짧았다고 밝혔습니다. 독립적인 재현 결과가 아니라 공급업체가 제시한 결과입니다.
Theo Browne은 9월 26일 벤치마크 보고서에서 참고할 만한 반대 사례를 제시했습니다. 그는 $1,000를 썼으며 DeepSWE 성능이 낮은 추론 강도의 GPT-6 Astra와 거의 같았고, 비용은 조금 더 들었으며 대기 시간은 거의 5배였다고 말했습니다. 이는 출처를 밝힌 벤치마크 결과입니다. $1,000의 라우터 수수료가 있었다는 증거는 아니며, 해당 게시물만으로는 요청별 과금 데이터가 부족해 이 글의 비용 질문에 결론을 내릴 수 없습니다.
구매자에게 여전히 중요한 지표는 채택된 과제당 비용입니다.
(selected-model cost + tools + allocated funding fee + retries + review time) / accepted tasks
$0 라우팅 항목은 이 분자를 줄일 수 있습니다. 나머지 항목까지 없애 주지는 않습니다.
개발자·운영자·구매자에게 미치는 영향
개발자는 연동이 단순해지는 대신 더 까다로운 의존성을 떠안습니다. 하나의 OpenAI 호환 모델 슬러그로 직접 만든 분류기, 정책표, 모델 호출, 일부 세션 로직을 대체할 수 있습니다. 대신 라우터가 모든 답변 앞단에 놓입니다. 문서에 명시된 fail-closed 동작을 고려하면 Jev 실패에 대응하는 애플리케이션 차원의 방안이 필요합니다. 한 번 재시도하거나, 사용자에게 다시 시도해 달라고 안내하거나, 자체 정책에 따라 고정 모델을 의도적으로 호출하는 식입니다.
최소한 응답 ID, 요청한 슬러그, 선택된 모델, 라우팅 이유, 추론 강도, 입력 토큰, 캐시 토큰, 출력 토큰, 추론 토큰, usage.cost, 지연 시간, 결과는 로그로 남겨야 합니다. 이 필드들이 없으면 모델 전환은 원인을 알 수 없는 가격 변동처럼 보이고, 품질 저하는 에이전트 버그처럼 보입니다.
운영자는 토큰 가격표가 아니라 세션 단위로 관리해야 합니다. 지원 코파일럿, 리서치 에이전트, 코딩 워크플로의 한 대화 안에도 쉬운 턴과 어려운 턴, 과제 전환이 함께 들어갈 수 있습니다. 어려운 턴이 추가 비용만큼의 가치를 낼 때만 더 쓰고, 그렇지 않을 때는 캐시를 유지하는 것이 핵심입니다. 채택된 과제, 재시도, 사람의 수정, 세션 총비용을 함께 측정해야 합니다.
구매자는 예산표에서 추론, 라우팅, 충전을 분리해야 합니다. 엔드포인트에 표시된 $0는 라우팅 항목에 넣습니다. 선택된 모델의 총비용은 실제로 확인한 뒤 사용량 항목에 넣습니다. 검색, 가져오기, 파일 처리와 기타 툴은 각각 별도 항목으로 둡니다. 5.5% 카드 수수료는 가상의 요청별 가산금이 아니라 크레딧 구매 비용으로 처리해야 합니다.
플랫폼 전체 비용은 공유 크레딧, BYOK, 충전 수수료를 다룬 기존 OpenRouter 가격 분석을 참고할 수 있습니다. 원래의 의사결정 모델 워크플로는 타입 지정 티켓 라우팅과 Jev 1.13의 $0.042/M 요율을 설명한 Jev 사용법에 정리돼 있습니다.
지금 도입할 팀, 기다릴 팀, 영향이 적은 팀
범위가 제한적이고 되돌릴 수 있는 에이전트 워크플로가 있으며, 평가 지출을 $1 미만으로 제한할 수 있고, 이미 각 생성 과정을 기록하고 있다면 지금 시험해 볼 수 있습니다. 중요도가 낮은 코딩 과제, 내부 리서치 루프, 섀도 모드 지원 어시스턴트가 적절한 평가 대상입니다. 라우팅이 영리하게 느껴진다는 점을 입증하려는 것이 아닙니다. 같은 프롬프트로 고정 모델과 비교해 채택된 과제당 비용과 지연 시간을 확인하는 것이 목표입니다.
고객 대상 요청이 fail-closed 의존성 하나를 더 감당할 수 없거나, 가변 라우팅을 운영에 투입하기 전에 재무팀이 서면 과금 규칙을 요구하거나, 규제 대상 데이터가 포함된 프롬프트가 개인정보 보호 검토를 통과하지 않았다면 기다리는 편이 낫습니다. 데이터 무보존 지원은 유용하지만 자체 데이터 흐름 승인을 대신하지는 않습니다.
고정 모델 하나가 이미 품질과 지연 시간 목표를 충족하거나, 워크로드가 Jev 1.13에 적합한 좁은 범위의 타입 지정 결정이거나, 로컬 DIY 프로젝트로 Claude Code와 Codex 구독을 의도적으로 라우팅하고 있다면 영향은 크지 않습니다. 관리형 라우터가 안정적인 직접 호출보다 언제나 나은 것은 아닙니다.
적응형 선택보다 제공업체를 직접 지정하는 일이 중요하다면 핵심 경로를 옮기기 전에 멀티 모델 라우팅을 위한 OpenRouter 대안을 비교해 보십시오.
Jev Router 무료 논의에서 과장된 주장
가장 심한 과장은 $0 모델 카드 하나만으로 전체 모델 생태계가 무료가 된다고 보는 것입니다. OpenRouter는 이를 뒷받침할 만큼 Jev 전용 과금 정보를 충분히 공개하지 않았으며, 공개 기계 판독 카탈로그에도 일반적인 고정 경로가 나타나지 않습니다.
반대 방향의 과장도 있습니다. 숨겨진 라우터 추가 요금이 반드시 존재한다고 보는 주장입니다. 이 조사에서는 그런 추가 요금이 문서로 확인되거나 실제로 관찰되지 않았습니다. 예산 전망에 임의로 추가하는 것은 날조입니다.
벤치마크도 맥락을 따져야 합니다. OpenRouter의 과제 해결 82% 향상 주장은 자사의 Auto Router와 비교한 공급업체 결과입니다. Theo의 $1,000 DeepSWE 보고서는 한 사용자가 하나의 고정 모델 설정과 비교한 벤치마크입니다. 어느 쪽도 사용자의 에이전트에서 채택된 과제당 비용을 알려 주지 않으며, 짧은 계정별 대조 검증을 대신할 수 없습니다.
마지막으로 1,000,000 토큰 컨텍스트 창이 있다고 해서 100만 토큰짜리 대화가 경제적인 것은 아닙니다. 긴 세션의 효율은 선택된 모델, 캐시 동작, 추론 강도, 과제 전환에 따라 달라집니다. 컨텍스트 한도는 처리 용량이지 예산이 아닙니다.
월요일에 실행할 4개 요청 비용 점검
소규모 합성 요청 4개면 가격 페이지를 한 주 더 해석하는 것보다 많은 사실을 확인할 수 있습니다. 툴은 끄고, 민감한 데이터는 사용하지 않으며, 짧은 출력을 요청하십시오. 누적 usage.cost가 $1에 가까워지면 중단합니다.
단일 턴 기준 요청 보내기
typesafe/jev-router에 “Return only the word READY.”를 보냅니다.X-OpenRouter-Metadata: enabled를 추가합니다. 전체 JSON을 저장하되 특히id,model,usage,openrouter_metadata를 보관합니다.짧은 작업 세션 시작하기
“In one sentence, explain why an idempotency key prevents duplicate charges.”라고 요청합니다. 같은 필드들을 저장합니다. 툴이나 외부 데이터 없이 간단한 기술 질문으로 세션을 시작하는 단계입니다.
전체 기록을 포함해 이어가기
앞선 사용자 메시지와 어시스턴트 답변을 다시 보낸 다음 “Give one counterexample in one sentence.”를 추가합니다. 선택된 모델이 유지되는지, 추론 강도가 달라지는지,
cached_tokens가 나타나는지 기록합니다.과제를 바꾸고 비용 대조하기
대화 기록을 유지한 채 URL이 HTTP 200을 반환하는지 확인하는 4줄짜리 셸 함수를 요청합니다. 4개 응답의
usage.cost를 모두 더합니다. 각 ID로 생성 기록을 불러온 뒤 선택된 모델, 토큰 수, 추론 토큰, 캐시 필드,total_cost를 Logs 또는 Activity와 비교합니다.
첫 요청은 아래 형식을 그대로 사용할 수 있습니다.
curl https://openrouter.ai/api/v1/chat/completions \
-H "Authorization: Bearer $OPENROUTER_API_KEY" \
-H "Content-Type: application/json" \
-H "X-OpenRouter-Metadata: enabled" \
-d '{
"model": "typesafe/jev-router",
"messages": [
{"role": "user", "content": "Return only the word READY."}
]
}' | tee jev-router-response.json그런 다음 응답 ID로 일치하는 생성 메타데이터를 가져옵니다.
GENERATION_ID=$(jq -r '.id' jev-router-response.json)
curl --get https://openrouter.ai/api/v1/generation \
--data-urlencode "id=$GENERATION_ID" \
-H "Authorization: Bearer $OPENROUTER_API_KEY"판정 규칙은 기계적으로 적용할 수 있습니다.
- 4개 응답의
usage.cost: 0, 4개 생성 기록의 총비용 0, 같은 키의 Activity 지출 증가 없음이 모두 확인되면 해당 계정과 날짜에 합성 세션의 비용이 0이었던 것으로 관찰할 수 있습니다. - 기록 중 하나라도 0이 아니면 선택된 모델과 비용 내역을 사용합니다. 카탈로그 배지에 무엇이 적혀 있든 해당 요청의 엔드투엔드 비용은 무료가 아닙니다.
- 응답, 생성 기록, Activity가 서로 다르면 일반화하지 마십시오. ID를 저장하고 어떤 기록이 실제 과금을 결정하는지 OpenRouter 지원팀에 문의합니다.
기준 테스트의 비용을 대조하기 전에는 툴을 추가하지 마십시오. 에이전트에 검색, 가져오기, 파일 처리를 넣은 뒤에는 통제된 요청 하나를 반복하고 해당 생성 비용 항목을 별도로 처리합니다. Jev Router 모델 카드만 보고 추정해서는 안 됩니다.
월요일에는 이 4개 요청과 고정 모델 요청 4개를 나란히 실행해 세션 비용, 지연 시간, 채택된 출력, 실패율을 비교하십시오. 카탈로그의 한 행에 0이 두 개 있다는 이유가 아니라, 라우팅 결정이 전체 결과를 개선할 때만 Jev Router를 도입해야 합니다.
다음 모델 라우팅 변경 사항과 예산에 미치는 영향을 검증된 정보로 받아보려면 뉴스레터를 구독하십시오.
- 마지막 업데이트
- 2026년 9월 26일
- 카테고리
- Build







