DeepSeek API 가격 총정리(2026): 무료 채팅과 100만 토큰당 $1 미만 요금

DeepSeek API 가격과 무료 채팅 범위를 한눈에 비교합니다. V4 Flash와 V4 Pro의 입출력 토큰 요금, 캐시 할인, 월별 비용 예시, 동시 요청 한도, Responses API 지원 여부, 3.11배 손익분기점과 가격 인상 위험까지 실제 운영 관점에서 정리했습니다.

Thursday, September 3, 2026Omid Saffari
DeepSeek API 가격 총정리(2026): 무료 채팅과 100만 토큰당 $1 미만 요금

DeepSeek 채팅은 $0에 이용할 수 있습니다. DeepSeek API 가격은 사용량 기준이며, 100만 토큰당 V4 Flash의 입력은 $0.14, 출력은 $0.28이고 V4 Pro는 각각 $0.435와 $0.87입니다. 선택 기준은 간단합니다. 개인 채팅은 무료로 이용하고, 프로덕션 작업은 Flash를 기본으로 쓰되 재시도를 충분히 줄여 3.11배의 가격 차이를 만회할 때만 Pro에 비용을 지불하면 됩니다.

DeepSeek API 가격 한눈에 보기

DeepSeek에는 무료 소비자용 제품 하나와 유료 API 모델 두 개가 있습니다. 셀프서비스 API에 월간 또는 연간 구독은 없으며, 사용한 만큼 계정 잔액에서 토큰 요금이 차감됩니다.

이 수치는 2026년 8월 12일 DeepSeek의 실시간 Models & Pricing 페이지에서 확인했습니다.

V4 Flash와 V4 Pro 요금이 표시된 DeepSeek 실시간 API 가격 페이지
2026년 8월에 확인한 DeepSeek Models & Pricing
선택지입력 1M토큰당출력 1M토큰당권장 판단
DeepSeek 채팅사용량 과금 없음사용량 과금 없음개인 채팅은 무료로 이용
V4 Flash-0731캐시 적중 $0.0028 / 캐시 미적중 $0.14$0.28기본 프로덕션 모델
V4 Pro캐시 적중 $0.003625 / 캐시 미적중 $0.435$0.87까다로운 예외 작업에만 상향

토큰은 모델이 요금을 매기는 단위이며, 요청이나 단어 단위가 아닙니다. 입력에는 지시문, 대화 기록, 문서, 툴 컨텍스트를 포함해 모델에 보내는 모든 내용이 들어갑니다. 출력은 모델이 반환하는 모든 내용입니다. 캐시 적중은 DeepSeek가 반복 입력을 재사용해 더 낮은 요율을 적용하는 경우이고, 캐시 미적중은 전체 요율로 처리해야 하는 입력입니다.

두 API 모델은 1M토큰 컨텍스트 윈도와 최대 384K 출력을 공통으로 제공합니다. 따라서 DeepSeek 안에서는 긴 컨텍스트 때문에 별도 할증 요금을 낼 일이 대체로 없습니다. 다만 운영 한도는 다릅니다. V4 Flash의 동시 요청 한도는 2,500건, V4 Pro는 500건으로 명시돼 있습니다.

DeepSeek 채팅은 무료지만 API 요금은 별도입니다

DeepSeek의 소비자용 앱은 무료입니다. 공식 앱 발표에 따르면 광고와 인앱 결제 없이 100% 무료이며, 현재 홈페이지도 채팅을 무료로 이용할 수 있다고 안내합니다.

하지만 채팅이 무료라고 해서 API까지 무료인 것은 아닙니다. 소비자용 앱은 사람이 사용하는 인터페이스이고, API는 소프트웨어가 호출할 때 사용량을 측정해 과금하는 제품입니다. DeepSeek API 페이지에 따르면 부여받았거나 충전한 잔액에서 사용료가 차감됩니다. 따라서 무료 채팅 계정이 있어도 프로그램에서 발생하는 트래픽까지 무료가 되지는 않습니다.

이처럼 같은 브랜드 아래 앱 구독과 API 과금이 별도 제품으로 운영되는 경우는 다른 서비스에서도 흔하며, Perplexity 가격 분석에서도 확인할 수 있습니다. DeepSeek는 앱에 공개된 구독료가 없는 반면 API의 모든 토큰에는 요금 항목이 있어 구분이 더욱 명확합니다.

비용을 전혀 낼 필요가 없는 경우

공식 웹이나 모바일 앱에서 가끔 대화형으로 사용하고 결과에 만족한다면 비용을 낼 필요가 없습니다. 개인적인 질문, 필요할 때 하는 글쓰기, 문서에 관한 대화, 그리고 DeepSeek를 다른 제품에 연결할 필요가 없는 학생의 이용이 여기에 해당합니다.

이번 리뷰를 위해 확인한 가격, FAQ, 앱 페이지 어디에도 DeepSeek의 학생 전용 요금제나 할인은 안내돼 있지 않습니다. 일반 소비자용 서비스는 이미 $0이므로 별도의 학생 요금제가 필요하지도 않습니다.

경계선은 자동화입니다. CRM, 고객 지원 워크플로, 사내 툴 또는 고객용 제품이 사람이 앱을 열지 않은 상태에서 DeepSeek를 호출해야 한다면 API 토큰 예산을 잡아야 합니다. 무료 채팅을 프로덕션 인프라처럼 취급해서도 안 됩니다. 무료 앱 페이지는 무제한 용량을 약속하지 않으며 서비스 수준도 공개하지 않습니다.

프로덕션 기본 모델은 V4 Flash, 예외 처리 경로는 V4 Pro입니다

대부분의 프로덕션 라우팅에서는 첫 요청을 DeepSeek V4 Flash-0731에 보내는 것이 좋습니다. 가격이 더 낮고, 명시된 동시 요청 한도는 더 높으며, 현재 지원하는 연동 범위도 더 넓기 때문입니다.

V4 Flash-0731

V4 Flash는 100만 토큰당 캐시 미적중 입력 $0.14, 캐시 적중 입력 $0.0028, 출력 $0.28를 부과합니다. 추론 모드와 비추론 모드, JSON 출력, 툴 호출, DeepSeek의 Anthropic 호환 API, Responses API를 지원합니다. 실시간 페이지에는 1M 컨텍스트 윈도, 최대 384K 출력, 동시 요청 2,500건으로 표시돼 있습니다.

이 조합은 분류, 추출, 요약, 초안 생성, 일상적인 코드 변경, 범위가 정해진 에이전트 단계에 적합합니다. 이런 작업은 명확한 합격 기준을 둘 수 있어, 잘못된 결과를 감지한 뒤 고객에게 도달하기 전에 상위 모델로 넘길 수 있습니다.

실패 비용이 크고 발견하기도 어렵다면 Flash 하나만으로 처리해서는 안 됩니다. 법률·금융 관련 조언이나 고객에게 영향을 주는 추천은 토큰 가격만 보고 모델을 골라서는 안 됩니다. 저렴한 요금은 평가할 여유를 줄 뿐, 평가 자체를 대신하지 않습니다.

V4 Pro

V4 Pro는 100만 토큰당 캐시 미적중 입력 $0.435, 캐시 적중 입력 $0.003625, 출력 $0.87를 부과합니다. 같은 1M 컨텍스트 윈도와 최대 384K 출력을 제공하고, 추론 모드, JSON 출력, 툴 호출, Anthropic 호환 형식도 동일하게 지원합니다. 명시된 동시 요청 한도는 500건입니다.

Pro는 모호한 요청, 복잡한 계획, 어려운 코딩 작업, 또는 Flash가 결정론적 검사를 통과하지 못한 뒤의 두 번째 시도처럼 까다로운 예외를 처리하는 경로입니다. 이름에 Pro가 붙었다는 이유만으로 기본 모델이 되는 것은 아닙니다.

실시간 표에는 놓치기 쉬운 연동 제약도 있습니다. DeepSeek는 현재 Flash에는 Responses API 지원을 표시하지만 Pro에는 지원하지 않는다고 명시합니다. 페이지에는 Pro 지원이 2026년 8월 초로 예정돼 있다고 여전히 적혀 있지만, 8월 12일 현재 실시간 상태는 미지원입니다. 애플리케이션이 이 엔드포인트에 의존한다면 연동이 제공되기 전까지 Pro의 토큰 가격은 의미가 없습니다.

강점
잘하는 것
10 points

  • 소비자용 앱은 광고나 인앱 결제 없이 $0입니다.
  • 현재 모든 API 요율이 100만 토큰당 $1 미만입니다.
  • 두 API 모델 모두 1M 컨텍스트 윈도와 최대 384K 출력을 제공합니다.
  • 자동 컨텍스트 캐싱으로 반복되는 접두부의 비용을 크게 낮출 수 있습니다.
  • V4 Flash는 최저 요금, 더 넓은 엔드포인트 지원, 더 높은 동시 처리 한도를 함께 제공합니다.
  • DeepSeek는 API 가격이 대폭 인상될 예정이라고 경고하지만, 인상 폭과 날짜는 밝히지 않았습니다.
  • 캐시 적중은 최선 노력 방식이며 보장되지 않습니다.
  • V4 Pro는 캐시 미적중과 출력 기준으로 Flash보다 약 3.11배 비쌉니다.
  • V4 Pro의 동시 처리 한도는 Flash의 5분의 1이며 현재 Responses API를 지원하지 않습니다.
  • 무료 채팅에는 공개된 무제한 용량 약속이나 서비스 수준이 없습니다.

DeepSeek의 토큰 비용은 작지만, 최종 판단은 채택된 결과당 비용입니다

API 자체 비용이 워낙 작아 불필요한 사람의 검토 한 번이 수천 번의 모델 호출 비용보다 클 수 있습니다. 유용한 기준은 요청당 비용이 아니라 채택된 결과당 비용입니다.

캐시 적중이 없는 요청의 계산식은 다음과 같습니다.

cost = input tokens / 1,000,000 × input rate + output tokens / 1,000,000 × output rate

1,000토큰 기준으로 V4 Flash는 캐시 미적중 입력에 $0.00014, 출력에 $0.00028가 듭니다. V4 Pro는 캐시 미적중 입력이 $0.000435, 출력이 $0.00087입니다.

답변 하나당 입력 2,000토큰과 출력 500토큰을 쓰는 고객 지원 초안 워크플로를 가정해 보겠습니다. 캐시 적중 없이 답변 1,000개를 만들면 Flash는 $0.42, Pro는 $1.305가 듭니다. 답변 1,000개당 Pro의 추가 비용은 전부 합쳐도 $0.885입니다.

여기에 인건비를 더해 보겠습니다. 시간당 비용을 예시로 $60라고 하면 5분 검토에 $5가 듭니다. 검토가 한 번만 더 생겨도 위에서 계산한 Pro 추가 비용 5회분보다 큽니다. 따라서 올바른 질문은 “어느 모델의 표면 요금이 더 낮은가?”가 아니라 “모델 비용과 검토 시간을 합쳤을 때 어느 경로가 합격 기준을 가장 저렴하게 통과하는가?”입니다.

DeepSeek 월별 비용은 얼마나 나올까?

DeepSeek에는 소프트웨어 구독처럼 사용자당 월 요금이 없습니다. 월별 비용은 트래픽 형태로 결정됩니다. 얼마나 많은 컨텍스트를 입력하고 얼마나 많은 텍스트를 출력하는지, 접두부가 얼마나 자주 캐시에 적중하는지, 채택 가능한 결과를 얻기까지 몇 번 시도하는지가 전부입니다.

개인 제품 프로토타입에서 한 달에 캐시 미적중 입력 10M토큰과 출력 2M토큰을 사용하면 Flash는 $1.96, Pro는 $6.09입니다. $4.13의 차이가 제품의 생존 여부를 결정하지는 않습니다. 디버깅을 덜 거치고 유효한 결과를 내는 모델이 더 중요합니다.

답변마다 입력 2,000토큰과 출력 500토큰을 쓰면서 100,000개의 고객 지원 답변 초안을 만드는 조직이라면, 캐시를 적용하지 않은 비용은 Flash $42.00, Pro $130.50입니다. 입력 캐시 적중률을 예시로 80% 적용하면 각각 $20.048과 $61.48로 내려갑니다. 이 정도 사용량에서도 시간당 $60 가정 아래서는 사람의 검토 1시간이 Flash의 월 전체 비용보다 클 수 있습니다.

입력 50,000토큰과 출력 2,000토큰을 사용하는 문서 분석 작업 1,000건의 캐시 미적용 비용은 Flash $7.56, Pro $23.49입니다. 입력의 80%가 캐시에 적중하면 각각 $2.072와 $6.235가 됩니다. 입력이 길다고 해서 DeepSeek 비용이 반드시 커지는 것은 아닙니다. 반복되는 긴 입력은 단위 경제성을 이례적으로 낮출 수 있습니다.

이 예시는 다른 회사의 고정 월간 추정치를 그대로 가져오는 일이 왜 쓸모없는지도 보여줍니다. 고객 지원 답변은 프롬프트 대비 출력 비중이 크고, 문서 작업은 입력 비중이 큽니다. 에이전트는 재시도와 툴 루프를 통해 두 비용을 모두 늘릴 수 있습니다. 비용 수치 옆에 토큰 구성을 함께 저장해야 재무 담당자가 트래픽, 품질, 공급업체 요율 중 무엇이 변화를 일으켰는지 구분할 수 있습니다.

Flash에서 Pro로 전환할 손익분기점

V4 Pro의 캐시 미적중 입력과 출력 요율은 모두 Flash의 3.107143배이며, 반올림하면 3.11배입니다. 토큰 구성이 같다면 Pro가 모델 비용만으로 손익분기점에 도달하려면 과금되는 시도 횟수나 토큰 사용량을 67.82% 줄여야 합니다.

Pro가 작업을 한 번에 끝낸다면 Flash는 평균 3.11번의 비슷한 시도를 해야 토큰 비용이 더 비싸집니다. Flash가 한두 번 만에 성공하면 가격 비교에서는 Pro가 불리합니다. Flash가 계속 네 번씩 시도해야 한다면 사람의 검토 비용을 넣기 전부터 Pro가 유리합니다.

사용자를 무료 DeepSeek 채팅, V4 Flash 또는 V4 Pro로 보내는 의사결정 흐름
먼저 워크플로에 맞춰 선택한 뒤, Pro가 3.11배 요율을 정당화하는지 확인합니다

이 라우팅 원칙은 흔한 구매 실수도 막아줍니다. 1달러 미만이라는 요율만 보고 모든 작업을 Pro에 보낸 뒤 전체 비용이 저렴하다고 판단하는 팀이 있습니다. 절대 금액은 여전히 작을 수 있지만, 수백만 건의 호출에 측정하지 않은 추가 비용을 얹는 것은 전략이 아닙니다. 범위가 정해진 기본 부하는 Flash가 맡고, 비용을 정당화하는 실패 사례는 Pro가 담당해야 합니다.

컨텍스트 캐싱은 접두부가 실제로 반복될 때만 비용을 바꿉니다

DeepSeek의 캐시 적중 요율은 매력적이지만, 스프레드시트에서 당연히 받을 할인처럼 가정할 수는 없습니다. 컨텍스트 캐싱 가이드에 따르면 캐싱은 기본으로 활성화되며, 저장된 완전한 접두부 단위에 적용되고, 최선 노력 방식으로 작동합니다.

안정적인 시스템 프롬프트 뒤에 변하지 않는 참고 문서가 이어진다면 캐시에 적합합니다. 이후 요청에서는 이 앞부분을 재사용하고 새 질문을 덧붙일 수 있습니다. 서로 다른 프롬프트의 중간에 있던 문구를 다시 쓴다고 해서 캐시 조건을 충족하지는 않습니다. DeepSeek가 저장한 단위와 완전한 접두부가 일치해야 합니다.

캐시에는 시간 조건도 있습니다. 생성에는 수 초가 걸리고, 사용하지 않은 항목은 보통 수 시간에서 수일 안에 삭제됩니다. 비슷한 요청이 짧은 시간에 몰리면 적중할 캐시도 주간 보고서 작업에서는 놓칠 수 있습니다. DeepSeek는 100% 적중률을 보장하지 않습니다.

입력 캐시 적중률을 예시로 80% 적용하면 100만 토큰당 혼합 입력 비용은 Flash $0.03024, Pro $0.08990까지 내려갑니다. 고객 지원 답변 1,000개 예시에서는 총비용이 Flash 기준 $0.42에서 $0.20048로, Pro 기준 $1.305에서 $0.61480으로 줄어듭니다.

출력이 포함된 이 워크로드에서는 전체 비용이 대략 절반으로 줄어드는 수준입니다. 캐시 적중과 미적중 입력 요율만 따로 비교할 때 보이는 거의 전부에 가까운 절감 폭은 아닙니다. 출력 토큰에는 입력 캐시 할인이 적용되지 않습니다.

  1. 접두부를 안정적으로 유지합니다

    오래 유지할 지시사항과 반복되는 참고 자료를 앞에 배치합니다. 프롬프트 순서를 매번 새로 구성하지 말고, 바뀌는 사용자 요청을 안정적인 접두부 뒤에 추가합니다.

  2. 사용량 필드를 확인합니다

    API 응답의 prompt_cache_hit_tokensprompt_cache_miss_tokens를 추적합니다. 예상 적중률은 이 필드에서 확인되기 전까지 과금 사실이 아닙니다.

  3. 실측된 구성으로 비용을 계산합니다

    측정된 입력을 적중 토큰과 미적중 토큰으로 나누고 출력 토큰을 더해 채택된 결과당 비용을 계산합니다. 프롬프트 구조나 트래픽 주기가 바뀌면 다시 계산합니다.

품질을 고려하기 전 순수 토큰 가격은 DeepSeek가 가장 저렴합니다

원시 토큰 가격 비교에서는 DeepSeek가 큰 차이로 앞섭니다. 그러나 모델마다 성능, 툴, 지연 시간, 실패율이 다르므로 비즈니스 성과까지 자동으로 앞서는 것은 아닙니다.

표면 가격을 같은 기준에서 비교하기 위해 캐시 할인 없이 총 입력 1M토큰과 출력 250K토큰을 쓰는 표준화된 워크로드를 적용해 보겠습니다. 이 워크로드의 비용은 V4 Flash $0.21, V4 Pro $0.6525이며 Pro 비용을 반올림하면 $0.65입니다.

OpenAI GPT-5.6 Sol은 100만 토큰당 입력 $5, 출력 $30를 부과합니다. 각 요청이 OpenAI의 긴 컨텍스트 기준 아래에 머문다면 표준화된 워크로드 비용은 $12.50으로 V4 Pro의 19.16배입니다. 입력 프롬프트가 272K토큰을 넘으면 해당 요청 전체에 입력 2배, 출력 1.5배의 요율이 적용되며, 캐시 쓰기는 캐시 미적용 입력 비용의 1.25배입니다.

Claude Sonnet 5은 100만 토큰당 입력 $2, 출력 $10를 부과합니다. 같은 워크로드는 $4.50으로 V4 Pro의 6.90배입니다. Anthropic은 표준 요금에 1M 컨텍스트 윈도를 포함하며 50% Batch 할인도 제공하므로, 지연을 허용할 수 있는 작업은 격차를 좁힐 수 있습니다.

Gemini 3.1 Pro Preview는 프롬프트가 200K 이하일 때 100만 토큰당 입력 $2, 출력 $12를 부과합니다. 모든 요청이 이 경계 아래에 있다면 표준화된 전체 워크로드 비용은 $5.00으로 V4 Pro의 7.66배입니다. 같은 워크로드를 200K를 넘는 요청 하나에 넣으면 Google 요율은 입력 $4, 출력 $18로 올라가며, 총비용은 $8.50, 즉 V4 Pro의 13.03배가 됩니다.

DeepSeek, Claude, Gemini, OpenAI의 표준화된 API 워크로드 비용을 비교한 막대그래프
입력 100만 토큰과 출력 250K토큰 기준, 캐시 할인 미적용

가격 배수의 격차는 크지만 실제 달러 차이는 그만큼 크게 느껴지지 않을 수 있습니다. 표준화된 워크로드를 V4 Pro에서 GPT-5.6 Sol로 옮길 때 추가되는 비용은 $11.8475입니다. 사람의 수정 한 번이 이 절감액을 없앨 수 있는 반면, 안정적인 대용량 경로라면 절감 효과가 누적됩니다.

토큰 표보다 모델 품질, 제품 기능, 데이터 처리가 중요하다면 DeepSeek와 ChatGPT 비교를 참고하면 됩니다. 더 작은 저가 모델과 게이트웨이를 사용할 수 있는 작업이라면 가장 저렴한 AI API 후보를 확인해 보세요. 가격 페이지는 요율을 표준화할 수 있지만, 결과를 표준화할 수 있는 것은 자체 평가뿐입니다.

숨은 예산 위험은 연간 약정이 아니라 가격 재조정입니다

DeepSeek의 실시간 페이지는 가까운 미래에 전체 API 가격이 인상될 예정이며, 예상 인상 폭이 상당하다고 밝힙니다. 하지만 인상 폭이나 시행일은 공개하지 않았습니다. 현재 요율은 검증된 사실이지만 미래의 배수는 모두 추측입니다.

이 경고는 구매 판단을 바꿉니다. 고객, 이사회, 재무팀에 8월 요율이 1년 동안 유지될 것이라고 약속해서는 안 됩니다. 모든 예산 모델 옆에 가격 페이지 확인일을 저장하고, 요율을 수정 가능한 입력값으로 두며, 어느 정도의 가격 변화가 발생하면 다른 경로로 전환할지 정해야 합니다.

월간 또는 연간 API 약정의 함정은 없습니다

DeepSeek는 월별 사용자 요금이나 연간 셀프서비스 계약이 아닌 토큰 기반 차감을 안내합니다. 충전 잔액은 만료되지 않습니다. 부여된 잔액은 만료될 수 있으며, 만료일은 Billing 페이지에 표시됩니다. 두 잔액이 모두 있으면 API는 부여된 잔액부터 사용합니다.

DeepSeek 공식 FAQ에 따르면 사용하지 않은 잔액은 Billing > Refunds에서 환불받을 수 있습니다. 따라서 적당한 금액을 충전하는 것은 환불 불가능한 연간 약정보다 위험이 작습니다. 단, 계정을 삭제하면 예외입니다. FAQ는 계정을 삭제할 경우 남아 있는 Open Platform 잔액을 잃는다고 경고합니다.

DeepSeek에는 후불 초과 사용으로 예상 밖의 요금이 붙는 문제도 없습니다. 잔액이 부족하면 API가 HTTP 402를 반환하고 충전을 요청합니다. 운영상 위험은 요금이 한도 없이 조용히 늘어나는 것이 아니라 서비스 중단입니다. 프로덕션 트래픽이 잔액 부족을 먼저 발견하기 전에 알림을 설정해야 합니다.

연동과 동시 처리 한도는 토큰보다 큰 비용을 만들 수 있습니다

Flash는 동시 요청 2,500건과 현재 Responses API 지원을 명시합니다. Pro는 500건이며 현재 Responses API를 지원하지 않습니다. 이런 한도를 확인하지 않고 Pro를 중심으로 설계하면 모델 비용이 100만 토큰당 1달러 미만이어도 대기열, 폴백 로직 또는 연동 작업에서 더 큰 비용이 생길 수 있습니다.

가장 저렴하면서 안전한 아키텍처는 라우팅을 언제든 바꿀 수 있게 유지합니다. 하나의 내부 인터페이스를 사용하고 선택한 모델과 토큰 사용량을 기록하며, 테스트를 마친 폴백을 보존합니다. DeepSeek의 가격 인상 경고를 고려하면 이런 기본적인 엔지니어링 원칙이 곧 예산 통제 수단입니다.

DeepSeek 가격 변천에서 Flash와 Pro의 방향이 갈렸습니다

V4가 모든 항목을 일률적으로 낮춘 것은 아닙니다. 현재의 등급 전략은 Flash 가격을 공격적으로 낮춘 반면 Pro의 캐시 미적중 입력에는 더 높은 가격을 유지했습니다.

DeepSeek의 V3 가격 발표에 따르면 100만 토큰당 캐시 적중 입력은 $0.07, 캐시 미적중 입력은 $0.27, 출력은 $1.10였습니다. 이 요율과 비교하면 V4 Flash는 캐시 적중 입력이 96.00%, 캐시 미적중 입력이 48.15%, 출력이 74.55% 저렴합니다.

V4 Pro의 변화는 다릅니다. 캐시 적중 입력은 V3보다 94.82%, 출력은 20.91% 저렴하지만, 캐시 미적중 입력 $0.435는 V3의 $0.27보다 61.11% 높습니다.

이 가격 변천을 보면 현재의 선택 원칙을 이해할 수 있습니다. Flash는 단순히 작은 이름표를 단 모델이 아니라 대량 사용에 초점을 맞춘 가격 전략입니다. Pro는 더 나은 결과로 높은 캐시 미적중 요율을 정당화해야 합니다. 예고된 다음 인상은 두 모델 모두를 바꿀 수 있으므로 계산 결과 옆에 확인일을 기록해야 합니다.

월요일의 실행 과제: 예산을 옮기기 전에 한 경로부터 측정합니다

월요일이 되면 범위가 명확한 워크플로 하나에서 개인정보를 제거한 요청 100개를 골라 1주일간 라우팅 테스트를 진행합니다. 전사 마이그레이션부터 시작하지 마세요.

  1. 먼저 합격 기준을 정합니다

    검토자가 일관되게 평가할 수 있는 결과를 고릅니다. 유효한 스키마, 올바른 분류, 테스트 통과, 승인된 고객 지원 초안 등이 될 수 있습니다. 평가 데이터에서 고객 정보, 개인정보, 기밀 데이터를 제거합니다.

  2. 기본 부하는 Flash로 보냅니다

    요청 100개를 모두 V4 Flash-0731로 실행합니다. 각 요청의 입력, 출력, 캐시 적중, 캐시 미적중, 재시도, 지연 시간, 합격 데이터를 기록합니다.

  3. 실패한 경우에만 상향합니다

    실패했거나 모호한 사례를 V4 Pro로 보냅니다. Pro가 3.11배의 모델 요율과 사람의 검토 시간을 상쇄할 만큼 실패 구간을 줄이는지 측정합니다.

  4. 예산 트리거 두 개를 설정합니다

    Flash가 품질 하한선을 통과하는 동안에만 기본 모델로 유지합니다. 가격 변동 후에도 실시간 표준화 비용이 테스트된 폴백보다 낮은 동안에만 DeepSeek를 공급업체로 유지합니다.

이 테스트에서 얻을 핵심 수치는 하나입니다. 바로 채택된 결과당 비용입니다. 이 수치는 DeepSeek의 매우 낮은 토큰 요금을 재무팀이 분석을 처음부터 다시 하지 않고도 검토할 수 있는 워크플로 예산으로 바꿔줍니다.

자주 묻는 질문

DeepSeek는 유료인가요, 무료인가요?

DeepSeek의 공식 소비자용 앱은 광고와 인앱 결제 없이 무료입니다. API 이용은 별도이며 캐시 적중 입력, 캐시 미적중 입력, 출력 토큰에 각각 요금이 부과됩니다.

DeepSeek V4 Pro 가격은 얼마인가요?

V4 Pro는 100만 토큰당 캐시 적중 입력 $0.003625, 캐시 미적중 입력 $0.435, 출력 $0.87입니다. 1M 컨텍스트 윈도와 최대 384K 출력을 제공하며, 명시된 동시 요청 한도는 500건입니다.

DeepSeek 월 요금은 얼마인가요?

소비자용 채팅은 월 $0입니다. API에는 고정 월 요금이 없습니다. 한 달간의 캐시 적중 입력, 캐시 미적중 입력, 출력 토큰 합계에 각각의 100만 토큰당 요율을 곱하면 됩니다.

DeepSeek가 ChatGPT보다 얼마나 저렴한가요?

가격만 비교하는 입력 1M토큰과 출력 250K토큰 워크로드에서 DeepSeek V4 Pro는 약 $0.65, OpenAI GPT-5.6 Sol은 긴 컨텍스트 기준 아래에서 $12.50로 19.16배 차이가 납니다. 모델 품질과 툴 지원이 다르므로 토큰이 아니라 채택된 결과를 비교해야 합니다.

DeepSeek에 학생 할인이 있나요?

2026년 8월에 확인한 공식 가격, FAQ, 앱 페이지에는 DeepSeek의 학생 전용 요금제나 할인이 없습니다. 학생이 이용하는 소비자용 웹 또는 모바일 앱의 이용료는 이미 $0입니다.

DeepSeek에서 환불받을 수 있나요?

네. 사용하지 않은 API 잔액은 Billing > Refunds에서 환불받을 수 있습니다. 충전 잔액은 만료되지 않지만, 부여된 잔액에는 만료일이 있을 수 있습니다. 계정을 삭제하면 남은 Open Platform 잔액을 잃습니다.

2026년에 DeepSeek 가격이 바뀌었나요?

네. 이전 V3 요금과 비교하면 V4 Flash는 캐시 미적중 입력이 48.15%, 출력이 74.55% 저렴합니다. V4 Pro 출력은 20.91% 저렴하지만 캐시 미적중 입력은 61.11% 높습니다. DeepSeek는 현재 인상 폭이나 날짜를 밝히지 않은 채 또 한 번의 대폭 인상을 예고하고 있습니다.

V4 Flash와 V4 Pro 중 무엇을 선택해야 하나요?

범위가 정해진 기본 부하는 Flash로 처리하고, 실패했거나 결과의 영향이 큰 사례는 Pro로 보냅니다. 캐시 미적용 모델 비용 기준으로 Pro가 Flash 대비 3.11배인 요율을 만회하려면 과금되는 시도 횟수나 토큰을 약 67.82% 줄여야 합니다.

비즈니스 리더를 위한 AI Tools Map 받기

AI Tools Map for Business Owners는 모델 가격을 실제 도입 스택으로 바꿔줍니다. 각 툴의 품질 하한선, 라우팅 역할, 비용 트리거를 정리한 다음 에디션을 무료로 받아보세요.

마지막 업데이트

2026년 9월 3일

카테고리AI

Google에서 이 사이트를 우선하기

Google 검색에서 omidsaffari.com을 선호 소스로 추가

omidsaffari.com을 선호 소스로 지정하면 Google이 Top Stories, AI Overviews, AI Mode에서 우선적으로 보여 줍니다.

AI의 다른 글

AI 글 전체 보기
뉴스레터

매주 일요일, 한 통의 편지. 뜨거운 의견이 아닌, 돌아가는 시스템.

AI 벤처 포트폴리오 운영에서 나오는 빌드 로그, 가동 중인 시스템, 현장 노트.

주간 발행. 스팸 없음. 언제든 해지 가능합니다.