8 月 17 日 DeepSeek 峰谷分时计费生效,高峰输出价格涨至 4 倍、周末全天转低谷。本文拆解「按场景路由 + 预算护栏 + 用量告警」三步错峰打法,教你用一道统一网关把 AI 账单直接砍半。
YesApi Pro 企业级 API 开放平台,支持 AI 转发按场景路由、单接口 QPS 与月度预算护栏、接口监控与访问日志告警,私有化部署 + 源码交付。
8 月 17 日 0 点,DeepSeek 峰谷分时计费正式生效;一周后的 8 月 23 日,官方又加了一条补丁:周六、周日全天不再区分峰谷,全部按低谷价走。
把两条新规放到一起看,结论很直接——「按便宜时段集中跑任务」这种省钱套路,已经写进 DeepSeek 的官方价表里。会用的人能把成本腰斩,不会用的人账单直接翻倍。
先看一眼高峰时段具体贵了多少。V4 Pro 工作日 9:00–12:00 和 14:00–18:00 是高峰,百万 tokens 输出 27 元;同样 V4 Pro,缓存未命中输入 9 元,缓存命中 0.3 元。空闲时段呢?输出 13.5 元、输入 4.5 元、缓存命中 0.15 元——正好是高峰的一半。再叠一层周末全天低谷,新规则等于把一周的「省钱窗口」从工作日夜里那点零碎时间,扩到周末 48 小时不间断。
高峰对比调价前,输出从 6 元涨到 27 元,约 4 倍。这正是「高峰调用贵 4 倍」的来源。
但新规真正的杀伤力,不在这一组数字上。新闻里那位做 AI 待办事项的开发者孙先生讲过一句话:「涨价前每月 API 支出约 3000 元,按现在的用量结构和时段分布,调价后月成本将升到近 1 万元,增加三到四倍。」——他做的事没变、流量没变、模型没变,唯一变的是调用时间分布撞上了高峰窗口。
这才是 8-17 之后所有用 DeepSeek 的团队都要面对的同一道题:当模型按小时收租,架构就得起一道「错峰路由」。
三个时间窗口,三档价格,业务不分时段地「调就完事」等于按高峰价 24 小时付钱
把 DeepSeek 的新规拉成一张表,更直观:
| 时段 | V4 Pro 输出(百万 tokens) | V4 Pro 输入(未命中) | V4 Pro 输入(命中) |
|---|---|---|---|
| 工作日高峰(9–12、14–18) | 27 元 | 9 元 | 0.3 元 |
| 工作日空闲 | 13.5 元 | 4.5 元 | 0.15 元 |
| 周末全天(低谷) | 13.5 元 | 4.5 元 | 0.15 元 |
三个时间窗口,三档价格。业务代码不分时段地「调就完事」,等于是按高峰价 24 小时付钱。
很多人第一反应是「那我把调用挪到下班后跑」。思路对,但只对了一半——能挪的只是非实时任务(批量生成、夜间总结、定时报告、离线分析)。用户在前端实时对话、客服兜底、风控拦截这种必须当下出结果的请求,挪不动。这一类请求占总调用的比例,往往比想象中高。
所以真正的解法,不是「让所有人都别在高峰调」,而是「在高峰时段,让该用旗舰模型的用旗舰,该用便宜模型的用便宜,该直接缓存返回的走缓存」。这件事靠人工调度肯定撑不住,得交给一道统一的网关层来做。
峰谷定价时代,最值钱的不是某一个模型,而是把请求按成本、场景、时段路由到合适模型的那道网关
不是「换模型」,是「按场景路由」。具体三件事并行做:
路由做对了,能省一半;但如果没设硬上限,单月费用仍可能超支数倍——这也是为什么「5 个月烧掉 180 万美元」那种事故,几乎都发生在「调得对、但没预算盖子」的团队身上。预算护栏三件套:
路由和预算都配好了,最后还差一双盯着的眼睛。原因很简单:流量是波动的,缓存命中率也是波动的,任何一个数字偏离预期一天,账单就能涨一截。用量告警要看到三件事:
把上面三步落到一起,会发现它们都依赖同一个底座——一道能看见所有调用、能配路由、能设预算、能发告警的网关。
这也是为什么我说:峰谷定价时代,统一网关的错峰路由比模型本身更值钱。
模型可以换,今年用 DeepSeek,明年可能用千问、豆包、自研模型——但「按场景路由 + 预算护栏 + 用量告警」这一套打法不依赖具体模型。只要网关在,模型可以无痛切换;如果只在每个业务系统里各写一套限流告警,模型一换或上游一调价,全部要重写。
模型是子弹,网关是枪膛。子弹会更新换代,枪膛决定精度和成本。
不是所有团队都需要这道网关,真正吃这套打法的,是下面这四类
企业级 API 低代码开发与接口开放平台,支持私有化部署 + 源码交付 + 接口计费,500+ 企业客户在用
在「AI 转发」里新建一条转发规则,按场景把不同请求路由到不同模型——简单问答走 V4-Flash、复杂推理走 V4-Pro、重复问题直接返回缓存。配置一次,全网生效,不用改业务代码。
同样是这条转发规则上,配月度调用上限、单接口 QPS、超额自动降级。当月费用过 80% 自动路由降级、过 100% 直接停非关键调用,不会等到月底才发现超了。
后台「接口监控」里直接看实时流量与每日统计;「接口访问日志」按调用方、模型、AppKey 实时留痕,任何一笔调用都能查到源头。
A:工作日高峰 9:00–12:00、14:00–18:00 为高峰价,V4 Pro 输出 27 元/百万 tokens、输入未命中 9 元、命中 0.3 元;工作日空闲与周末全天为低谷价,输出 13.5 元、输入 4.5 元、命中 0.15 元——高峰约为低谷的 2 倍、调价前的约 4 倍。
A:三步——① 高峰把简单/可缓存请求路由到低价模型(V4-Flash)或缓存,复杂推理才走 V4-Pro;② 设月度硬预算 + 按模型单独限流 + 超 80% 自动降级;③ 开实时流量、每日账单、访问日志三类告警,异常当天就能发现。
A:路由、预算、告警这套打法不依赖具体模型。只要网关在,上游调价或切换 DeepSeek/千问/豆包时只需改配置、无需重写各业务系统的限流告警代码,模型可无痛切换。
A:在「AI 转发」建转发规则配按场景路由;同一条规则上配月度上限、单接口 QPS、超额自动降级;后台「接口监控」看实时流量与每日统计、「接口访问日志」按调用方/模型/AppKey 留痕。网关、限流、路由、计费、告警、审计一个后台配完。