每天早上一封邮件,把昨天的 AI 梳理好订阅邮件

METAL LAB

DeepSeek V4 Pro 正式上线,API 价格表公开

100万token上下文,输入0.435美元/输出0.87美元,缓存复用时费用大幅降低

딥시크 v4 모델 사양과 가격을 비교한 표

이미지: X — 뉴스 앰프 화면 갈무리

摘要

  • DeepSeek公开了DeepSeek-V4-Pro正式服务(GA)阶段的价格表
  • 模型版本为DeepSeek-V4-Pro-0813,上下文长度100万token,缓存未命中时每百万输入token收费0.435美元,输出为0.87美元
  • 并发处理上限为500个,低于轻量版模型Flash(2500个)
모델 버전
DeepSeek-V4-Pro-0813
컨텍스트 길이
100만 토큰 (최대 출력 38.4만 토큰)
입력 가격(캐시 미스)
100만 토큐당 0.435달러
입력 가격(캐시 히트)
100만 토큰당 0.003625달러
출력 가격
100만 토큰당 0.87달러
동시 처리 한도
500건 (Flash는 2500건)

价格表中的数字

DeepSeek的DeepSeek-V4-Pro进入正式服务(GA)阶段,同时公开了价格表。模型版本为DeepSeek-V4-Pro-0813,上下文长度为100万token,单次可输出的最大token数为38.4万。价格设定为每百万输入token 0.435美元、每百万输出token 0.87美元。不过,当同一提示词被再次调用时适用的缓存命中输入价格为每百万token 0.003625美元,降至缓存未命中价格的约百分之一水平。并发处理上限为500个,低于轻量版Flash(2500个)。两款模型均可在思考模式与非思考模式之间切换使用,并同时支持OpenAIAnthropic两种API格式。一家新闻账号对此价格表评价称"疯狂的价格"。

这是什么情况

DeepSeek-V4-Pro是8月9日率先上传至Hugging Face的模型。当时公开的版本采用FP8(8位浮点)精度,以MIT许可证发布,模型卡片中写明其目标是支持百万级token规模的上下文处理。此次公开的价格,应理解为该模型正式以API形式投入商用服务后确定的收费标准。按缓存命中与未命中分别定价的方式,是OpenAI等主要API服务商已经采用的结构——当系统提示词或重复出现的文档等相同输入多次进入时,无需重新计算该部分内容,直接复用即可降低成本。DeepSeek此前也曾以低价策略引发竞争对手的价格战,此次V4-Pro的定价也可以视为同一战略的延续。100万token的上下文长度,相当于可以一次性将一整本书的文本输入模型并进行提问的水平,这对长文档摘要或大型代码库分析等任务尤为有利。

由此带来的变化

以V4系列为中心,DeepSeek生态正在快速扩张。此前在8月11日,Together AI已开始支持轻量版DeepSeek V4 Flash 0731的微调,Nous Research也在自家API网关上为V4 Flash提供最高90%的折扣。随着Pro模型的GA价格被设定在较低水平,开发者有了更大空间以相对较低的成本试验处理长文档的服务。不过,仅凭此次信息来源,尚难判定这份价格表是临时促销措施还是长期政策。

DeepSeek,在Hugging Face公开DeepSeek-V4-Pro