作者:互联网 时间: 2026-08-18 09:47:55
据深度求索官方消息,DeepSeek-V4 系列 API 全新计费策略已于今日零时起正式上线,同步宣布 V4-Pro 模型结束内测,全面进入商用阶段。此次调整摒弃了原有的统一费率机制,创新引入业内罕见的“算力峰谷分级定价”模式——高峰时段资费直接提升至空闲时段的两倍。
峰谷时段划分及对应资费标准
平台将每日两个区间设为高峰时段:上午 9:00 至 12:00、下午 14:00 至 18:00;其余时间均为空闲时段。所有费用以“元 / 百万 tokens”为统一计量单位。以 V4-Flash 模型为例:空闲时段输入缓存命中价为 0.05 元、未命中为 1.5 元、输出为 4.5 元;进入高峰时段后,三者分别上调至 0.10 元、3.0 元与 9.0 元。
V4-Pro 定位更高端,整体报价上浮一级:空闲时段输入缓存命中 0.15 元、未命中 4.5 元、输出 13.5 元;高峰时段则对应为 0.30 元、9.0 元和 27.0 元。两款模型均完整支持工具调用(Tool Calling)、Responses API、Anthropic 兼容协议、多轮对话续写及 FIM(Fill-in-the-Middle)代码补全能力,最大上下文窗口达 384K tokens。
算力调度优化:价格机制驱动资源均衡
本次峰谷定价机制的核心目标在于实现算力资源的动态均衡配置,鼓励开发者主动将任务向低负载时段迁移。借助价格信号这一市场化调节手段,平台旨在缓解高峰请求集中带来的系统压力,改善此前偶发的服务延迟或响应波动问题,从而全面提升服务稳定性与可靠性。
V4 系列模型在架构层面深度适配长文本理解、代码生成、智能体(Agent)构建及企业级批量推理等真实业务场景,384K 的超大上下文长度足以满足绝大多数商业化应用需求。对开发者而言,合理规划非实时类任务的执行时间,将其迁移至空闲时段运行,可在保障模型性能不变的前提下大幅压缩调用支出。此举也标志着 DeepSeek 正式迈入以效率、成本与体验并重的精细化运营新周期。