机器之心编辑部

本周二晚间,DeepSeek 开放平台发布公告,计划再次调整大模型 API 定价,这次是喜闻乐见的降价。

打开网易新闻 查看更多图片

闲时价格统一为:输入(缓存命中)0.02 元、输入(缓存未命中)1 元、输出 4 元(单位均为元 / 百万 token)。高峰时段价格仍为空闲时段的两倍,即缓存命中 0.04 元、缓存未命中 2 元、输出 8 元。

打开网易新闻 查看更多图片

本次调整只涉及 V4-Flash 系列,定位更高的 V4-Pro 价格维持不变。新价格将在北京时间 9 月 10 日 12:00 生效。

官方同时明确,高峰时段为北京时间周一至周五 9:00–12:00、14:00–18:00,其余为空闲时段。

此前,DeepSeek 的涨价引发了人们的广泛讨论。官方给出的解释是为了更合理地调配资源,鼓励用户调整任务执行时间。外界则普遍认为是 DeepSeek V4 Flash 0731 性价比很高,吸引了全球用户的大量调用,以及 DeepSeek 缺乏足够算力。

纵向对比一下,8 月 17 日零时涨价前,Flash 是统一价 0.02 元(缓存命中)/ 1 元(未命中)/ 2 元(输出)。把这次的新价格摆进去:

打开网易新闻 查看更多图片

也就是说,输入侧的两项价格回到了涨价前,输出仍是涨价前的两倍。若按高峰时段算差距则更大:新高峰价 0.04 / 2 / 8 元,对比涨价前的 0.02 / 1 / 2 元,分别是 2 倍、2 倍和 4 倍。

因此,用户能否真正回到过去「放开了用」的状态,取决于自身应用的三个变量:缓存命中率、输入输出比例、以及任务可错峰的程度。对长上下文、固定系统提示词、Agent 循环调用这类缓存命中率高的场景,降幅会很明显;对以生成输出为主的场景,感受有限。众所周知 DeepSeek API 的缓存命中率是比较高的,所以目前大家给出的反应比较乐观。

本次降价并非孤立事件,昨天下午,DeepSeek 在官方交流群宣布V4.1 Flash 中间版本开启内测:模型名为 deepseek-v4.1-flash-expires-on-0910,base_url 不变,每账号限流 20 并发,计费暂与 V4 Flash 相同。

新模型除了原生多模态、极快的推理速度之外,官方还表示通过架构的升级让成本更低。可见通过大模型本身的工程与技术优化,DeepSeek 一直在尝试改进推理成本的问题。

expires-on-0910 这个模型名字说明,新模型 9 月 10 日就会自动过期下线 —— 与降价生效是同一天。

这个月,前沿 AI 公司纷纷更新了自己的大模型,DeepSeek 的 V4.1 正式版如果能够带来明显的能力跃升,配合这次降价,或许可以再来一波大的。