9月9日,DeepSeek 开放平台发布调价公告:自北京时间 2026年9月10日12:00起,调整 Flash 系列大模型(含 deepseek-v4-flash 等主力推理模型)的 API 调用价格,继续沿用峰谷分时计费模式。这是 DeepSeek 在 8 月优化峰谷规则、推出周末统一低价之后,年内再次下调主力推理模型价格。

一、具体价格:让利集中在缓存命中

新版定价将一天分为空闲与高峰两段。空闲时段(工作日非高峰、周末全天)输入缓存命中单价 0.02 元/百万 Token、输入缓存未命中 1 元/百万 Token、输出 4 元/百万 Token;高峰时段为周一至周五 9:00-12:00、14:00-18:00,各项价格均为空闲时段的 2 倍。对比旧版,空闲时段缓存命中输入降幅达 60%,缓存未命中输入降幅约 33%,输出降幅约 11%。

二、为什么是缓存命中先让利

缓存命中对应的是「同一段上下文被反复使用」的场景:高频重复调用、批量内容处理、以及智能体常驻推理(Agent 在多轮任务中反复引用系统提示与历史)。把这部分单价压到 0.02 元,直接降低了长链路 Agent 的运行门槛。配合持续降价与精细化分时定价,Flash 系列「高性价比、低延迟」的产品定位被进一步夯实。

三、客观看点:与「集体涨价」形成对照

这与此前行业观察到的「国产大模型 API 集体涨价、海外反向降价」并非同一叙事——并非所有国产模型都在涨。DeepSeek 以低价、高吞吐主攻中低端推理与智能体开发市场,对中小开发者和 Agent 常驻场景是直接降本。但需注意:高峰时段价格仍为空闲的 2 倍,长任务若落在工作日上午,成本会明显上升,调度策略因此变得重要。价格战的下半场,比的是谁能把单位推理成本真正做低。