
이미지: X — 뉴스 앰프 화면 갈무리
摘要
- DeepSeek公开了DeepSeek-V4-Pro正式服务(GA)阶段的价格表
- 模型版本为DeepSeek-V4-Pro-0813,上下文长度100万token,缓存未命中时每百万输入token收费0.435美元,输出为0.87美元
- 并发处理上限为500个,低于轻量版模型Flash(2500个)
- 모델 버전
- DeepSeek-V4-Pro-0813
- 컨텍스트 길이
- 100만 토큰 (최대 출력 38.4만 토큰)
- 입력 가격(캐시 미스)
- 100만 토큐당 0.435달러
- 입력 가격(캐시 히트)
- 100만 토큰당 0.003625달러
- 출력 가격
- 100만 토큰당 0.87달러
- 동시 처리 한도
- 500건 (Flash는 2500건)
价格表中的数字
DeepSeek的DeepSeek-V4-Pro进入正式服务(GA)阶段,同时公开了价格表。模型版本为DeepSeek-V4-Pro-0813,上下文长度为100万token,单次可输出的最大token数为38.4万。价格设定为每百万输入token 0.435美元、每百万输出token 0.87美元。不过,当同一提示词被再次调用时适用的缓存命中输入价格为每百万token 0.003625美元,降至缓存未命中价格的约百分之一水平。并发处理上限为500个,低于轻量版Flash(2500个)。两款模型均可在思考模式与非思考模式之间切换使用,并同时支持OpenAI和Anthropic两种API格式。一家新闻账号对此价格表评价称"疯狂的价格"。
这是什么情况
DeepSeek-V4-Pro是8月9日率先上传至Hugging Face的模型。当时公开的版本采用FP8(8位浮点)精度,以MIT许可证发布,模型卡片中写明其目标是支持百万级token规模的上下文处理。此次公开的价格,应理解为该模型正式以API形式投入商用服务后确定的收费标准。按缓存命中与未命中分别定价的方式,是OpenAI等主要API服务商已经采用的结构——当系统提示词或重复出现的文档等相同输入多次进入时,无需重新计算该部分内容,直接复用即可降低成本。DeepSeek此前也曾以低价策略引发竞争对手的价格战,此次V4-Pro的定价也可以视为同一战略的延续。100万token的上下文长度,相当于可以一次性将一整本书的文本输入模型并进行提问的水平,这对长文档摘要或大型代码库分析等任务尤为有利。
由此带来的变化
以V4系列为中心,DeepSeek生态正在快速扩张。此前在8月11日,Together AI已开始支持轻量版DeepSeek V4 Flash 0731的微调,Nous Research也在自家API网关上为V4 Flash提供最高90%的折扣。随着Pro模型的GA价格被设定在较低水平,开发者有了更大空间以相对较低的成本试验处理长文档的服务。不过,仅凭此次信息来源,尚难判定这份价格表是临时促销措施还是长期政策。



