DeepSeek官宣大降价:最高降60%
本周二晚间,
闲时价格统一为:输入(缓存命中)0.02 元、输入(缓存未命中)1 元、输出 4 元(单位均为元 / 百万 token)。高峰时段价格仍为空闲时段的两倍,即缓存命中 0.04 元、缓存未命中 2 元、输出 8 元。
本次调整只涉及 V4-Flash 系列,定位更高的 V4-Pro 价格维持不变。新价格将在北京时间 9 月 10 日 12:00 生效。
官方同时明确,高峰时段为北京时间周一至周五 9:00–12:00、14:00–18:00,其余为空闲时段。
此前,
纵向对比一下,8 月 17 日零时涨价前,Flash 是统一价 0.02 元(缓存命中)/ 1 元(未命中)/ 2 元(输出)。把这次的新价格摆进去:
也就是说,输入侧的两项价格回到了涨价前,输出仍是涨价前的两倍。若按高峰时段算差距则更大:新高峰价 0.04 / 2 / 8 元,对比涨价前的 0.02 / 1 / 2 元,分别是 2 倍、2 倍和 4 倍。
因此,用户能否真正回到过去「放开了用」的状态,取决于自身应用的三个变量:缓存命中率、输入输出比例、以及任务可错峰的程度。对长上下文、固定系统提示词、Agent 循环调用这类缓存命中率高的场景,降幅会很明显;对以生成输出为主的场景,感受有限。众所周知
本次降价并非孤立事件,昨天下午,
新模型除了原生多模态、极快的推理速度之外,官方还表示通过架构的升级让成本更低。可见通过大模型本身的工程与技术优化,
expires-on-0910 这个模型名字说明,新模型 9 月 10 日就会自动过期下线 —— 与降价生效是同一天。
这个月,前沿 AI 公司纷纷更新了自己的大模型,
本文来自微信公众号“机器之心”(ID:almosthuman2014),作者:关注大模型的机器之心,编辑:机器之心编辑部,36氪经授权发布。















