2026 年 8 月 17 日 00:00(北京时间)起,DeepSeek API 正式实行峰谷分时定价:非高峰时段(每天 09:00-12:00、14:00-18:00 以外的所有时间)统一按高峰价的 50% 计费。这意味着同一个模型、同样的调用,换个时间跑就能省一半的钱——对跑批量 Agent 任务的团队来说,这是 8 月最值得做的「零代码降本」动作。本教程带你读懂新计费表、识别可挪移的任务、用调度器排进低谷时段,并和模型分层路由组合成「模型×时段」双维降本。
先读懂新计费表:哪些时段半价、各模型多少钱
新规核心只有一句话:非高峰 = 高峰价 × 50%。先记住时段,再看价格:
| 时段 | 计费系数 | 说明 |
|---|---|---|
| 高峰 | 100% | 每日 09:00-12:00、14:00-18:00 |
| 非高峰 | 50% | 其余全部时间(含夜晚、凌晨、周末) |
| 模型 | 峰值输出价 | 非高峰输出价 |
|---|---|---|
| V4-Pro | ¥27 / $3.96(每百万 token) | ¥13.5 / $1.98 |
| V4-Flash | ¥9 / $1.32 | ¥4.5 |
清醒一下:别只看到「半价」——这次调价同时上调了基础价。V4-Pro 非高峰输出已是旧价的约 2.25 倍,峰值约 4.5 倍。DeepSeek 的低价时代结束了,现在需要主动管理调用时段才能把成本压住。
Step 1:盘点你的调用结构,找出可挪移任务
把线上调用按「延迟敏感度」分三类,只有中间那类适合挪到低谷:
类别 A:延迟敏感(不可挪)
- 用户实时对话、在线问答、支付类流程
→ 留在高峰,接受原价
类别 B:批量/定时(强烈建议挪)
- 每日报表生成、日志分析、数据清洗、
批量代码审查、知识库更新、邮件分类
→ 排进非高峰,直接省 50%
类别 C:可容忍延迟(视情况挪)
- 异步任务、消息队列消费者、测试跑批
→ 能挪就挪,挪不了就接受
建议:先拉一周的 API 调用日志,
按接口/任务类型统计用量与时段分布。
Step 2:用调度器把批量任务排进低谷
把「提交任务」的动作挪到非高峰即可,无需改模型逻辑。三种常见调度方式任选:
方式 1:服务器 cron(Linux/macOS)
# 每天 20:00 跑批量分析(20:00 属非高峰)
0 20 * * * /path/to/batch_job.sh
方式 2:Python APScheduler
from apscheduler.schedulers.blocking import ...
scheduler.add_job(run_batch, 'cron', hour=20)
# 注意避开 09-12 与 14-18 两个高峰窗口
方式 3:GitHub Actions(云上定时)
schedule:
- cron: '0 20 * * *' # UTC 12:00 = 北京 20:00
注意:非高峰时段很大(每天 18 小时+),
选「任务刚好做完、结果早上能看」的时间最香。
Step 3:接入新能力——Responses API 与一键 Codex
配合本次调价,DeepSeek 还发布了 V4-Pro 正式版(GA),面向 Agent 场景有几个新能力值得顺手用上:
1. 自适应推理模式:low / standard / maximum
三档,按任务难度选档(简单任务用 low,
别让所有请求都跑满配推理)
2. 原生支持 OpenAI Responses API:
迁移路径顺滑,兼容层改动小
3. 一键 Codex 配置:编程 Agent 接入更省事
4. 端点不变:现有集成不用改地址,
模型名与参数按官方文档调整即可
Step 4:混合调度——延迟敏感与批量任务分流
生产环境通常「实时 + 批量」并存,用路由把它们分开:
统一入口(API Gateway / Agent 编排层)
│
├─ 实时通道 → 立即调用(接受高峰价)
│ 对话、在线工具调用、支付确认
│
└─ 批量通道 → 进队列,非高峰时段消费
报表、数据清洗、批量审查、知识库更新
实现要点:
- 批量通道用消息队列(Redis/Celery/SQS)
- 消费者脚本判断「当前是否高峰」:
peak 则 sleep 到 12:00/18:00 后继续
- 优先级高的批量任务可允许提前消费
Step 5:与分层路由组合——「模型×时段」双维降本
本教程的「时段维度」和《分层路由》的「模型维度」不冲突,可以叠加:
降本矩阵(模型 × 时段):
高峰(100%) 非高峰(50%)
V4-Pro → 复杂任务 复杂批量任务
(必须实时) (可等 3 小时)
V4-Flash → 简单实时任务 简单批量任务
(对话/提取) (日报/清洗)
组合收益示例:
- 原全部走 V4-Pro 高峰:成本 = 1.0
- 简单任务降级 V4-Flash:省 30-50%
- 批量任务挪非高峰:再省 50%
- 两者叠加,总成本可压到原来的 1/3 左右
进阶参考:前缀缓存(Reasonix)还能再省一层
《DeepSeek Reasonix 前缀缓存》
Step 6:监控与复盘——让降本可验证
降本动作做完,必须配上监控和复盘,否则省没省、省多少都是糊涂账:
1. 用量看板:按「时段 × 模型 × 任务类型」
统计 token 消耗与费用(DeepSeek 控制台
自带用量报表,可导出)
2. 告警:单日费用超过阈值时告警,
防止异常调用(如死循环任务)烧钱
3. 周复盘:对比「挪移前后」批量任务成本,
验证节省幅度是否达标
4. 预算护栏:给高风险任务设每日 token 上限,
可参考《Agent 预算护栏》的做法
安全自检:挪时段 ≠ 放松质量。批量任务挪到非高峰后,记得检查「任务完成率、延迟、失败重试率」有没有变化——省的应该是钱,不该是质量。
常见问题速查
| 你遇到的问题 | 原因 & 解决 |
|---|---|
| 高峰/非高峰具体几点 | 高峰=每日 09:00-12:00、14:00-18:00;其余全为非高峰(含周末全天) |
| 时区按什么算 | 以北京时间(UTC+8)为准,注意服务器时区与 cron 配置要一致 |
| 实时任务也想省钱 | 实时任务改用推理档位 low/standard 或降级 V4-Flash,别动时段 |
| 价格比旧版贵了 | 是的,基础价上调;主动挪移批量任务 + 分层路由是当前最有效的对冲 |