实战 📋 6 个步骤 第 284 / 470 篇

DeepSeek API 峰谷定价 8/17 生效:非高峰半价,把 Agent 批量任务挪进省钱时段

DeepSeek 8-17 起实行分时定价:非高峰时段(09:00-12:00、14:00-18:00 以外)统一按高峰价 50% 计费,V4-Pro 非高峰输出低至 ¥13.5/百万 token。本教程教你读新计费表、识别可挪移任务、用调度器排进低谷,并与模型分层路由组合成「模型×时段」双维降本。

2026.08.17· 15 分钟阅读· 约 1833 字· 💰 DeepSeek API

2026 年 8 月 17 日 00:00(北京时间)起,DeepSeek API 正式实行峰谷分时定价:非高峰时段(每天 09:00-12:00、14:00-18:00 以外的所有时间)统一按高峰价的 50% 计费。这意味着同一个模型、同样的调用,换个时间跑就能省一半的钱——对跑批量 Agent 任务的团队来说,这是 8 月最值得做的「零代码降本」动作。本教程带你读懂新计费表、识别可挪移的任务、用调度器排进低谷时段,并和模型分层路由组合成「模型×时段」双维降本。

📌 本教程适合:API 用量大、有批量/定时任务的团队,以及想优化 Agent 成本的个人开发者。想了解 DeepSeek 模型侧的分层路由降本可看《DeepSeek 分层路由》;V4 Pro 模型本身的上手可看《V4 Pro 迁移实操》。

先读懂新计费表:哪些时段半价、各模型多少钱

新规核心只有一句话:非高峰 = 高峰价 × 50%。先记住时段,再看价格:

时段计费系数说明
高峰100%每日 09:00-12:00、14:00-18:00
非高峰50%其余全部时间(含夜晚、凌晨、周末)
模型峰值输出价非高峰输出价
V4-Pro¥27 / $3.96(每百万 token)¥13.5 / $1.98
V4-Flash¥9 / $1.32¥4.5

清醒一下:别只看到「半价」——这次调价同时上调了基础价。V4-Pro 非高峰输出已是旧价的约 2.25 倍,峰值约 4.5 倍。DeepSeek 的低价时代结束了,现在需要主动管理调用时段才能把成本压住。

Step 1:盘点你的调用结构,找出可挪移任务

1 不是所有调用都能挪,先分类

把线上调用按「延迟敏感度」分三类,只有中间那类适合挪到低谷:

类别 A:延迟敏感(不可挪)
  - 用户实时对话、在线问答、支付类流程
  → 留在高峰,接受原价

类别 B:批量/定时(强烈建议挪)
  - 每日报表生成、日志分析、数据清洗、
    批量代码审查、知识库更新、邮件分类
  → 排进非高峰,直接省 50%

类别 C:可容忍延迟(视情况挪)
  - 异步任务、消息队列消费者、测试跑批
  → 能挪就挪,挪不了就接受

建议:先拉一周的 API 调用日志,
按接口/任务类型统计用量与时段分布。
💡 判断标准一句话:「这个结果 3 小时后拿到行不行?」行 → 挪去非高峰。报表、批处理、内部工具基本都是这类。

Step 2:用调度器把批量任务排进低谷

2 cron 一句,任务自动等半价

把「提交任务」的动作挪到非高峰即可,无需改模型逻辑。三种常见调度方式任选:

方式 1:服务器 cron(Linux/macOS)
  # 每天 20:00 跑批量分析(20:00 属非高峰)
  0 20 * * * /path/to/batch_job.sh

方式 2:Python APScheduler
  from apscheduler.schedulers.blocking import ...
  scheduler.add_job(run_batch, 'cron', hour=20)
  # 注意避开 09-12 与 14-18 两个高峰窗口

方式 3:GitHub Actions(云上定时)
  schedule:
    - cron: '0 20 * * *'   # UTC 12:00 = 北京 20:00

注意:非高峰时段很大(每天 18 小时+),
选「任务刚好做完、结果早上能看」的时间最香。
🔑 高峰窗口是 09-12 与 14-18,两个窗口之间(12-14)也是非高峰。午休时段跑批也是个好选择。

Step 3:接入新能力——Responses API 与一键 Codex

3 V4-Pro GA 后的接入升级

配合本次调价,DeepSeek 还发布了 V4-Pro 正式版(GA),面向 Agent 场景有几个新能力值得顺手用上:

1. 自适应推理模式:low / standard / maximum
   三档,按任务难度选档(简单任务用 low,
   别让所有请求都跑满配推理)
2. 原生支持 OpenAI Responses API:
   迁移路径顺滑,兼容层改动小
3. 一键 Codex 配置:编程 Agent 接入更省事
4. 端点不变:现有集成不用改地址,
   模型名与参数按官方文档调整即可
💡 建议把「推理档位」也纳入调度策略:批量任务用 standard,关键复杂任务才开 maximum——又一个省钱杠杆。

Step 4:混合调度——延迟敏感与批量任务分流

4 一个入口,两条通道

生产环境通常「实时 + 批量」并存,用路由把它们分开:

统一入口(API Gateway / Agent 编排层)
  │
  ├─ 实时通道 → 立即调用(接受高峰价)
  │    对话、在线工具调用、支付确认
  │
  └─ 批量通道 → 进队列,非高峰时段消费
       报表、数据清洗、批量审查、知识库更新

实现要点:
- 批量通道用消息队列(Redis/Celery/SQS)
- 消费者脚本判断「当前是否高峰」:
  peak 则 sleep 到 12:00/18:00 后继续
- 优先级高的批量任务可允许提前消费
📈 这一步把「时段优化」固化成了系统能力,而不是靠人肉记得几点提交任务——降本才可持续。

Step 5:与分层路由组合——「模型×时段」双维降本

5 两个降本维度叠加,效果翻倍

本教程的「时段维度」和《分层路由》的「模型维度」不冲突,可以叠加:

降本矩阵(模型 × 时段):

              高峰(100%)      非高峰(50%)
V4-Pro    →   复杂任务         复杂批量任务
              (必须实时)     (可等 3 小时)
V4-Flash →   简单实时任务     简单批量任务
              (对话/提取)    (日报/清洗)

组合收益示例:
- 原全部走 V4-Pro 高峰:成本 = 1.0
- 简单任务降级 V4-Flash:省 30-50%
- 批量任务挪非高峰:再省 50%
- 两者叠加,总成本可压到原来的 1/3 左右

进阶参考:前缀缓存(Reasonix)还能再省一层
《DeepSeek Reasonix 前缀缓存》
💡 落地顺序建议:先做时段挪移(改动最小、见效最快),再做模型分层(需要评估质量),最后加前缀缓存(需要工程改造)。

Step 6:监控与复盘——让降本可验证

6 用数据说话,别凭感觉省

降本动作做完,必须配上监控和复盘,否则省没省、省多少都是糊涂账:

1. 用量看板:按「时段 × 模型 × 任务类型」
   统计 token 消耗与费用(DeepSeek 控制台
   自带用量报表,可导出)
2. 告警:单日费用超过阈值时告警,
   防止异常调用(如死循环任务)烧钱
3. 周复盘:对比「挪移前后」批量任务成本,
   验证节省幅度是否达标
4. 预算护栏:给高风险任务设每日 token 上限,
   可参考《Agent 预算护栏》的做法

安全自检:挪时段 ≠ 放松质量。批量任务挪到非高峰后,记得检查「任务完成率、延迟、失败重试率」有没有变化——省的应该是钱,不该是质量。

常见问题速查

你遇到的问题原因 & 解决
高峰/非高峰具体几点高峰=每日 09:00-12:00、14:00-18:00;其余全为非高峰(含周末全天)
时区按什么算以北京时间(UTC+8)为准,注意服务器时区与 cron 配置要一致
实时任务也想省钱实时任务改用推理档位 low/standard 或降级 V4-Flash,别动时段
价格比旧版贵了是的,基础价上调;主动挪移批量任务 + 分层路由是当前最有效的对冲
← 返回教程中心