DeepSeek V4-Flash 正式版上线时带来的峰谷定价机制,在开发者圈子里讨论度不低。表面上它只是把价格表改成了两档,但仔细看会发现,这其实是在用价格杠杆引导大家重新审视自己的调用习惯——尤其是那些对延迟敏感、又长期跑着大批量任务的团队。

先看具体规则。北京时间每天 09:00 到 12:00、14:00 到 18:00 被划为高峰时段,其余时间包括夜间和周末都算闲时。高峰时段的 Token 费用直接翻倍,闲时则相当于打了五折。以 V4-Flash 为例,闲时输出费用是每百万 Token 4.5 元,高峰就变成 9 元;未命中缓存的输入费用也从闲时 1.5 元涨到 3 元。这个价差幅度不小,足以影响不少项目的成本结构。
这里有个容易被忽略的点:峰谷定价本质上是在用价格信号调度算力资源。闲时资源充裕,响应通常更稳定;高峰时段大家都在抢算力,出现排队或限流的可能性自然更高。所以这不仅仅是省钱的问题,还牵扯到业务容错设计。如果某个功能必须在工作日的上午十点准时响应,那它注定要承担高峰成本,预算里就得按两倍费用预留。
反过来看,很多任务其实没那么“急”。比如数据清洗、离线批处理、定时生成摘要、夜间索引更新这类工作,完全可以挪到闲时跑。把任务调度到晚间或周末,成本直接降一半,对预算敏感的团队来说是相当实在的缓冲。再加上 V4-Flash 原生兼容 OpenAI Responses API,调用格式几乎不用改,迁移成本很低,这就让“换一个时段再跑”这件事变得更容易落地。
选型时不妨先问自己两个问题:业务的实际调用高峰在什么时段?对响应时效的要求到底有多硬?如果大部分请求本来就集中在闲时,那 V4-Flash 的性价比很突出;如果高峰调用不可避免,就需要在预算、任务拆分和缓存策略之间做权衡。峰谷定价真正考验的,其实是团队对自身流量画像的理解程度。你怎么看这种用价格引导算力分配的做法,是更公平了,还是给开发者添了新的计算负担?
参与讨论
暂无评论,快来发表你的观点吧!