
요약
- 딥시크가 DeepSeek-V4-Pro의 정식 서비스(GA) 요금표를 공개했다
- 모델 버전은 DeepSeek-V4-Pro-0813, 컨텍스트 100만 토큰에 캐시 미스 입력 100만 토큰당 0.435달러, 출력 0.87달러다
- 동시 처리 한도는 500건으로 경량 모델 Flash(2500건)보다 낮게 책정됐다
- 모델 버전
- DeepSeek-V4-Pro-0813
- 컨텍스트 길이
- 100만 토큰 (최대 출력 38.4만 토큰)
- 입력 가격(캐시 미스)
- 100만 토큐당 0.435달러
- 입력 가격(캐시 히트)
- 100만 토큰당 0.003625달러
- 출력 가격
- 100만 토큰당 0.87달러
- 동시 처리 한도
- 500건 (Flash는 2500건)
요금표에 붙은 숫자들
딥시크의 DeepSeek-V4-Pro가 정식 서비스(GA) 단계로 넘어가면서 요금표가 공개됐다. 모델 버전은 DeepSeek-V4-Pro-0813, 컨텍스트 길이는 100만 토큰이고 한 번에 뽑아낼 수 있는 최대 출력은 38만4000토큰이다. 가격은 입력 100만 토큰당 0.435달러, 출력 100만 토큰당 0.87달러로 책정됐다. 다만 같은 프롬프트를 다시 부를 때 적용되는 캐시 히트 입력 가격은 100만 토큰당 0.003625달러로, 캐시 미스 가격의 100분의 1 수준까지 떨어진다. 동시 처리 한도는 500건으로, 경량판인 Flash(2500건)보다 낮게 잡혀 있다. 두 모델 모두 생각 모드와 비생각 모드를 오가며 쓸 수 있고, 오픈AI·앤스로픽 두 API 형식을 모두 지원한다. 한 뉴스 계정은 이 가격표를 두고 "정신나간 가격"이라고 평했다.
이게 무슨 얘긴가
DeepSeek-V4-Pro는 지난 8월 9일 허깅페이스에 먼저 올라온 모델이다. 당시 공개된 버전은 FP8(8비트 부동소수점) 정밀도를 쓰고 MIT 라이선스로 풀려 있었으며, 백만 토큰 규모의 컨텍스트 처리를 지향한다고 모델 카드에 적혀 있었다. 이번에 공개된 것은 그 모델이 API로 상용 서비스에 들어가면서 확정된 요금이라고 보는 게 맞다. 캐시 히트와 캐시 미스를 나눠 가격을 매기는 방식은 오픈AI 등 주요 API 사업자들이 이미 쓰는 구조로, 시스템 프롬프트나 반복되는 문서처럼 똑같은 입력이 여러 번 들어올 때 그 부분을 다시 계산하지 않고 재사용해 비용을 깎아주는 원리다. 딥시크는 이전에도 저가 정책으로 경쟁사 가격 경쟁을 촉발한 전례가 있는 회사인데, 이번 V4-Pro 요금도 같은 전략의 연장선으로 읽힌다. 100만 토큰이라는 컨텍스트 길이는 책 한 권 분량의 텍스트를 한 번에 모델에 넣고 질문할 수 있는 수준이라, 긴 문서 요약이나 대규모 코드베이스 분석 같은 작업에 특히 유리하다.
그래서 무엇이 달라지나
딥시크 생태계는 V4 패밀리를 중심으로 빠르게 확장되는 중이다. 앞서 8월 11일 Together AI는 경량판 DeepSeek V4 Flash 0731의 파인튜닝 지원을 시작했고, Nous Research는 자사 API 게이트웨이에서 V4 Flash에 최대 90% 할인을 걸어뒀다. Pro 모델의 GA 요금이 낮게 잡히면서, 개발자들은 긴 문서를 다루는 서비스를 상대적으로 적은 비용으로 시험해볼 여지가 커졌다. 다만 이번 가격표가 프로모션성 한시 조치인지 장기 정책인지는 이번 소스만으로는 단정하기 어렵다.





댓글