自其 R1 模型于 2025 年 1 月推出以来,DeepSeek 一直是 AI 行业的价格底线。它的费率低到开发者默认会将高吞吐量工作路由给它,如今中国模型在 OpenRouter 上占据了大部分流量,这是开发者跨厂商选购模型的市场。周三,这家杭州公司改变了这一低价策略。它宣布正式发布其旗舰模型 DeepSeek-V4-Pro,并在同一篇帖子中公布了新的 API 价格表。

新费率将于 8 月 16 日 16:00 UTC 生效。根据模型、token 类型以及一天中的时段不同,涨幅将在当前价格基础上增加 50% 到 1,100%,这是 Reuters 根据该公司声明计算得出的区间。V4-Pro 的输出价格,也就是模型生成文本的费用,将从每百万 tokens 0.87 美元提高到一天中大部分时段的 1.98 美元,并在一个持续 7 小时的峰值时段升至 3.96 美元。

这件事的大致轮廓并非秘密。DeepSeek 在 8 月 6 日告诉开发者,广泛涨价即将到来,并提醒他们据此规划,但没有说明涨多少,也没有说明何时实施。答案在一周后随产品发布一同揭晓。

该公司将这次变动描述为折扣。“非高峰时段费率比高峰时段低 50%,”DeepSeek 在其发布公告中写道,并称这是一种让工作负载调度更灵活的方式。这里的参照点是新的峰值费率,而不是旧的统一费率。到目前为止,V4-Pro 每百万输出 tokens 在任何一天的任何时段价格都相同。从周日开始,这一价格将大致变为今天的 2.3 倍到 4.6 倍,而你最终支付哪一端取决于你的任务在何时运行。

峰值与非高峰定价将于 8 月 16 日实施

高峰时段为 UTC 时间 01:00 至 04:00 以及 06:00 至 10:00,根据 DeepSeek 的 API 定价页面。其余时间均为非高峰时段。价格更低的 V4-Flash 模型也将调整:输入价格从 0.14 美元升至非高峰 0.22 美元、高峰 0.44 美元;输出价格从 0.28 美元升至 0.66 美元和 1.32 美元。

涨幅最大的是缓存输入,即当请求重复系统已处理过的文本时所收取的折扣费率。对于 V4-Pro,这一价格将从每百万 tokens 0.003625 美元升至非高峰 0.022 美元、高峰 0.044 美元,最高端涨幅超过 1,100%。而 Agent 软件会在每次循环中重复发送相同指令,正是最依赖缓存的那类工作负载。

V4-Pro-0813 在 DeepSeek 自测中的得分

这一端点背后的模型是 DeepSeek-V4-Pro-0813,标志着自 4 月 24 日开始的预览阶段结束。它采用混合专家(Mixture-of-Experts)设计,总参数量为 1.6 万亿,任一给定 token 激活 490 亿参数,可读取最多 100 万 tokens 的上下文,并生成最多 384,000 tokens。它已在应用中以“专家模式”上线,支持 OpenAI 的 Responses API 和一键 Codex 设置,并提供从低到最高的推理强度设置。它更便宜的同系列模型此前已经在 7 月在 agent 测试中得分高于这款旗舰预览版

DeepSeek 公布的表格显示,V4-Pro-0813 在衡量模型驱动命令行能力的 Terminal Bench 2.1 上得分 87.9,落后于 Kimi-K3 的 88.3 和 Claude Fable 5 的 88.0。它在 10 个项目中领跑 2 项:在安全基准 Cybergym 上得分 83.3,在公开的 AutomationBench 上得分 31.8。在“人类最后考试”(Humanity's Last Exam)中,它在不使用工具的情况下得分 42.7,而 Fable 5 为 53.3。脚注称,编程代理的数据来自尚未发布的内部测试框架,在其他框架下结果可能不同。没有任何外部实验室验证过这些结果。

成本差距缩小了,但并未消失

即便到了周日之后,DeepSeek 的价格仍远低于其对标对象。Claude Fable 5 的标价为每百万输入和输出 tokens 分别 10 美元和 50 美元。xAI 在 V4-Pro 发布同一天推出了 Grok 4.6,价格为 2 美元和 6 美元,是最便宜的西方前沿选项之一。按完整峰值费率计算,V4-Pro 的价格为 1.32 美元和 3.96 美元。

DeepSeek 正在测试的是,那些让它成为开放市场上使用最广模型家族的开发者,买的是能力还是低价。如果他们留下来,其他所有实验室都会获得停止打折的空间。价格底线刚刚上移,而其上方的所有人都会注意到。