Note: This page does not support English, using the default language version
8月13日凌晨,DeepSeek V4 Pro 正式版悄无声息地上线了。没有发布会,没有通稿,官方只是更新了一行定价页,模型版本号从预览版悄然变成了 DeepSeek-V4-Pro-0813。同一晚马斯克的 Grok 4.6 也在抢头条,媒体戏称这是「梁文锋对垒马斯克」。
这篇不写评测套路——性能数据大家都看得到。我更想聊的是:这次发布背后,有意思的东西到底是什么。
先说最实际的。
DeepSeek V4 Pro 正式版的 API 定价:每百万输入 token 3元,每百万输出 token 6元,缓存命中仅 0.025元。
作为对比,Claude Fable 5 的输出价格是每百万 token 约 360元。V4 Pro 的 6元,是它的 六十分之一。即便是对比 Opus 5(约180元),也是三十分之一。
这个数字意味着什么?我算了笔账:我自己每天大约要把几百段代码丢给模型做 review,假设一天烧 20 万输出 token,用 Fable 5 要 72 元,换成 V4 Pro 只要 1.2 元。一个月差两千多块,一年差出一辆二手电驴。
当然,这里有个坑——官方已经在定价页预告「计划近期整体上调 API 服务定价,预计涨幅较大」,而且高峰时段(9:00-12<00>00>、14:00-18<00>00>)价格会直接翻倍,V4 Pro 高峰输出会到 12 元。所以现在的低价,大概率是上线初期的「开业酬宾价」。
但即便如此,正式版的价格依然极具竞争力。
能力层面,这次实打实的两个升级点:
100万 token 上下文,最大输出 38.4 万 token。这意味着你可以一次把一整本技术文档、大型代码仓库整个塞进去,省掉以前切块、上 RAG 的中间步骤。对于需要处理超长文本或大量代码的场景,这个提升是真实的效率跃升。
Agent 能力增强。这是这次正式版被点名最多的升级。第三方机构 SemiAnalysis 的测试显示,V4 Pro 和 Flash 在 Agent 相关测试中甩开了参数量更大的英伟达 Nemotron 3 Ultra。官方公布的跑分数据中,Terminal Bench 2.1 达到 87.9,与 Kimi K3(88.3)和 Fable 5(88.0)几乎持平;DeepSWE 从预览版的 12.8 涨到 62.7,翻了近 5 倍,还反超了 Opus 4.8。
跑分我建议打八折听——毕竟全是 DeepSeek 自家 harness 测的,目前没有第三方完整复现。但价格是白纸黑字骗不了人的,能力就自己上手验。
DeepSeek V4 Pro 的发布,意义不只是「又出了一个强模型」,而是 AI 能力的价格体系正在被重新定义。
Fable 5 输出每百万 token 50 美元,V4 Pro 输出每百万 token 0.87 美元——两者性能接近,价格差了 57 倍。这个差距不是技术代差造成的,而是定价策略和市场定位的差异。
对于预算敏感、能接受自测的团队,现在就能把低风险调用切过去——我的建议是不要一天内把全部生产流量压上去,先跑一周真实任务再决定是否上生产。开源社区已经有人在把 Claude Code 的 base_url 改一行就接上 DeepSeek 后端了,这说明模型的 API 兼容性确实做到了开箱即用。
DeepSeek V4 Pro 正式版赢在价格和性价比,不是赢在「全面碾压」。但六十分之一的价格差,已经足够让很多人重新考虑自己的模型选型了。
低价窗口期可能不长,且用且珍惜。
Loading comments...