
Qzone
微博
微信
极客网·人工智能 2026年8月17日零时起,DeepSeek-V4系列API全新定价正式生效。此次调价最大的亮点,是取消了此前行业通行的统一计费模式,首次引入“算力错峰分级计价”方案。这一模式在大模型行业中极为少见。
根据新规,每日被划分为高峰与空闲两个时段:高峰时段为9:00-12:00和14:00-18:00,其余时间均为空闲时段。在计费标准上,空闲时段定价仅为高峰时段的一半。这意味着同样的API调用,在高峰时段要比空闲时段贵上一倍。
价格调整幅度相当可观。以旗舰模型DeepSeek-V4-Pro为例:调价前,缓存命中输入价格为0.025元/百万tokens;新规下,空闲时段涨至0.15元,高峰时段进一步升至0.30元,分别是原价的6倍和12倍。输出价格则从6元涨至空闲时段的13.5元、高峰时段的27元,高峰时段涨幅高达350%。轻量级模型V4-Flash同样告别了此前的“白菜价”,高峰时段输出价格从2元涨至9元。
为何要引入这套看似复杂的定价模式?答案藏在算力资源本身的特点里。AI算力属于不可储存资源,具备极强的供需潮汐特征——日间企业办公时段,模型调用、智能交互需求集中爆发,GPU集群负载拉满,容易出现响应延迟甚至限流卡顿;而夜间及周末时段,大量高端算力设备却闲置空转。此前的统一计价模式实际上是用闲时富余算力补贴高峰压力,长期来看让厂商持续承压,商业化闭环难以成型。
错峰分级计价的核心逻辑,正是用市场化价格信号“削峰填谷”,引导非实时、可错峰的任务分流至闲时时段,系统性提升算力资源整体利用效率。官方表示,此举旨在通过价格杠杆调节算力负载,平衡日间算力拥堵,提升平台整体服务稳定性。
从行业视角看,DeepSeek此次率先试水算力分时定价,为国产大模型行业提供了新的运营范式。过去两年,国产大模型依靠“以价换量”的低价策略抢下了海量开发者;但随着调用量持续攀升,DeepSeek-V4-Flash单日处理Token总量已达8万亿,低价模式的可持续性受到严峻考验。有分析人士指出,此次峰谷定价并非单纯涨价,而是算力资源稀缺背景下的标准化调度工具。
对开发者而言,新定价意味着更精细的成本管理成为必修课。将非实时任务调度至空闲时段运行,有望在不牺牲效果的前提下显着降低调用成本。这也标志着DeepSeek乃至整个国产大模型行业,正在从粗放的低价补贴阶段,走向算力精细化运营的新阶段。
【以上内容转自“极客网”,不代表本网站观点。如需转载请取得极客网许可,如有侵权请联系删除。】