DeepSeek V4即将上线:峰谷时段定价的「AI错峰用电」时代来了

· 科技资讯

🔥 **关注 → 星标 → 不迷路**

2024年你还在为GPT的Pro订阅付200美元月费,2026年的DeepSeek告诉你:未来AI调用价格会和电费一样分峰谷时段——晚上更便宜。这不是电力公司的广告,而是DeepSeek V4正式版7月中旬上线时同步推出的定价策略。

DeepSeek V4即将上线:峰谷时段定价的「AI错峰用电」时代来了封面

🔥 从「一口价」到「分时定价」:API经济学的一次范式转移

DeepSeek团队6月30日宣布,V4正式版将于7月中旬上线,同时推出峰谷时段差异化定价——高峰时段(北京时间9:00-23:00)维持标准价格,低谷时段(23:00-9:00)价格大幅下调。这是大模型API服务领域首次引入时间维度的定价机制。

把AWS的Spot Instance逻辑搬到AI推理上——利用算力闲置窗口降本,然后让利给错峰用户。这不仅是定价策略,更是一张算力调度网络的基础设施蓝图。

放眼全球,OpenAI GPT-5的API定价约为每百万输入Token 15美元,Anthropic Claude 4在相近价位区间,而DeepSeek V4高峰时段价格仅为前者的五分之一,低谷时段更是低至十分之一。对于日均Token消耗超过千万的应用来说,选择错峰调用可将月度API开支从数万美元压缩到数千美元——这对现金流紧张的初创团队而言是生死攸关的差距。典型的受益场景包括:批量数据处理与报表生成(可设定凌晨自动运行)、非实时的内容审核流水线、知识库索引构建、以及面向海外用户的时差错峰客服机器人。

目前DeepSeek V4预览版已在API中可用(`deepseek-v4-pro` / `deepseek-v4-flash`),而旧的 `deepseek-chat` 和 `deepseek-reasoner` 两个模型名将于7月24日正式退役。所有开发者需要在Deadline前完成迁移。

🔥 V4的技术底牌:不只是便宜

据TechNode报道和Reddit社区透露,V4的核心升级方向包括:

1M上下文窗口:足以一次吞下整本《三体》三部曲

推理效率大幅提升:在保持输出质量的同时降低延迟

工具调用与Agent能力增强:对标Claude和GPT-5系列的自主编程能力

DeepSeek的策略很清晰:不和OpenAI拼「谁的模型更聪明」,而是拼「谁能让开发者在同样的预算下多跑10倍的Token」。性价比赛道,DeepSeek已是全球领先的定价锚。

据多方评测数据,V4在MMLU-Pro基准上较V3提升约12个百分点(82%→94%),在HumanEval代码生成任务中的通过率从78%跃升至91%,MATH数学推理得分也提高了近15%。更关键的是,V4在长文本检索与多步工具调用场景下的稳定性显著优于V3——1M上下文窗口下关键信息召回率保持在97%以上,而V3在超过128K Token后就会出现明显的注意力衰减。

🔥 7月24日Deadline:开发者迁移倒计时

`deepseek-chat` 和 `deepseek-reasoner` 两个旧模型名将在7月24日下线。wavespeed.ai 的分析指出,迁移到新模型名(`deepseek-v4-pro` / `deepseek-v4-flash`)几乎是「改一行代码」的工作量,但如果忘记迁移——7月25日起你的API调用将直接报错。

对于已经在用DeepSeek的开发者来说,现在就该把迁移列入Sprint。对于还在观望的团队,V4的峰谷定价可能是说服CTO通过预算的最后一根稻草。

🔥 对中国AI生态的深层影响

DeepSeek的峰谷定价不仅是商业策略,更揭示了两个产业趋势:

1. 算力供给正在从「稀缺」走向「可调度」——中国智算中心建设加速(截至2025年6月日均Token消耗突破30万亿),算力资源池化后,时段定价是资源利用率优化的必然结果。

2. 中国AI模型正从「追赶性能」转向「定义商业规则」——DeepSeek V4的定价模式可能成为行业标准,就像AWS EC2定义云计算计费方式一样。

当一家中国AI公司开始「定义规则」而非「遵循规则」,全球AI竞争格局的转折点就到了。

👇 **关注不迷路,星标更靠谱**

2026年7月1日 | LC智趣厅

ihygg.cn · AI科技资讯每日精选


— END —
LC 智趣厅 · 科技与生活的交点
ihygg.cn

滚动至顶部
微信公众号:LC智趣厅

扫码关注微信公众号
LC智趣厅