METAL for iPhone

AI 新闻, 现在用 App 阅读。

下载 METAL, 每天发现最新 AI 报道。

在 App Store 下载

iPhone 应用 · 免费下载

也可在 iPhone 的 App Store 中搜索 METAL AI Magazine。

METAL

DeepSeek V4 Pro 正式上线,API 价格表公开

100万token上下文,输入0.435美元/输出0.87美元,缓存复用时费用大幅降低

DeepSeek V4 Pro 正式上线,API 价格表公开

摘要

  • DeepSeek公开了DeepSeek-V4-Pro正式服务(GA)阶段的价格表
  • 模型版本为DeepSeek-V4-Pro-0813,上下文长度100万token,缓存未命中时每百万输入token收费0.435美元,输出为0.87美元
  • 并发处理上限为500个,低于轻量版模型Flash(2500个)

价格表中的数字

DeepSeek的DeepSeek-V4-Pro进入正式服务(GA)阶段,同时公开了价格表。模型版本为DeepSeek-V4-Pro-0813,上下文长度为100万token,单次可输出的最大token数为38.4万。价格设定为每百万输入token 0.435美元、每百万输出token 0.87美元。不过,当同一提示词被再次调用时适用的缓存命中输入价格为每百万token 0.003625美元,降至缓存未命中价格的约百分之一水平。并发处理上限为500个,低于轻量版Flash(2500个)。两款模型均可在思考模式与非思考模式之间切换使用,并同时支持OpenAI和Anthropic两种API格式。一家新闻账号对此价格表评价称"疯狂的价格"。

这是什么情况

DeepSeek-V4-Pro是8月9日率先上传至Hugging Face的模型。当时公开的版本采用FP8(8位浮点)精度,以MIT许可证发布,模型卡片中写明其目标是支持百万级token规模的上下文处理。此次公开的价格,应理解为该模型正式以API形式投入商用服务后确定的收费标准。按缓存命中与未命中分别定价的方式,是OpenAI等主要API服务商已经采用的结构——当系统提示词或重复出现的文档等相同输入多次进入时,无需重新计算该部分内容,直接复用即可降低成本。DeepSeek此前也曾以低价策略引发竞争对手的价格战,此次V4-Pro的定价也可以视为同一战略的延续。100万token的上下文长度,相当于可以一次性将一整本书的文本输入模型并进行提问的水平,这对长文档摘要或大型代码库分析等任务尤为有利。

由此带来的变化

以V4系列为中心,DeepSeek生态正在快速扩张。此前在8月11日,Together AI已开始支持轻量版DeepSeek V4 Flash 0731的微调,Nous Research也在自家API网关上为V4 Flash提供最高90%的折扣。随着Pro模型的GA价格被设定在较低水平,开发者有了更大空间以相对较低的成本试验处理长文档的服务。不过,仅凭此次信息来源,尚难判定这份价格表是临时促销措施还是长期政策。

评论