#DeepSeekV4ProApproachingFable5


DeepSeek V4 Pro 接近 Fable 5:AI 竞赛不再只是比谁最聪明

DeepSeek V4 Pro 的官方更新显示,其能力实现了大幅跃升,尤其是在编码、推理、工具使用和智能体任务方面。多项测试显示,其表现越来越接近 Claude Fable 5 等前沿模型,尽管其结果并不在所有基准测试中都一致。
然而,最重要的并不只是“DeepSeek 几乎追平了 Fable 5”。
真正发生变化的是,获得前沿级 AI 智能的成本。
性能差距缩小,价值竞争加剧
DeepSeek V4 Pro 于 8 月中旬正式结束预览阶段,相比上一版本实现了大幅提升。据 Reuters 援引 Artificial Analysis 的独立测试,该模型在 Intelligence Index 中获得 53 分,高于 V4 Flash 的 40 分。
与此同时,DeepSeek 的官方评测数据显示,其在复杂任务上表现强劲。在 Max 模式下,V4 Pro 的成绩包括 90,1% 的 GPQA Diamond、93,5% 的 LiveCodeBench,以及 Codeforces 的 3.206 分评级。然而,其他基准测试仍然表明,没有任何一个模型能够在所有类别中绝对胜出。
这正是 AI 竞赛中的重要变化:
顶尖模型与竞争对手之间的差距正在缩小,而成本和可访问性方面的差异可能变得越来越关键。
不再只是聊天机器人,而是能够工作的智能体
DeepSeek 也进一步强化了对 AI 智能体能力的关注,即 AI 不仅能够回答问题,还可以使用工具、执行多步骤流程,并完成更复杂的任务。伴随 V4 Pro 的更新,DeepSeek 还将智能体软件 DeepSeek Harness 作为开源项目推出。

这意味着,下一阶段的竞争可能不再是:
“哪个 AI 能给出最好的答案?”
而是:
“哪个 AI 能以最高效的方式完成实际工作?”
结论
DeepSeek V4 Pro 尚未在所有测试中自动击败 Fable 5。事实上,最新报告显示,该模型在一些评测中仍然落后。
但这恰恰是重点。
当更便宜且更开放的模型能够接近前沿参与者的能力时,AI 市场将进入一个新阶段。优势不再仅由最高的基准测试分数决定,而是取决于性能、成本、速度、可访问性以及执行实际工作的能力的组合。
DeepSeek V4 Pro 可能尚未赢得整场竞赛。但它正在帮助改变竞赛规则:最好的 AI 不一定总是最昂贵的。
查看原文
此页面可能包含第三方内容,仅供参考(非陈述/保证),不应被视为 Gate 认可其观点表述,也不得被视为财务或专业建议。详见声明
893次观看
  • 赞赏
  • 评论
  • 转发
  • 分享
评论
请输入评论内容
请输入评论内容
暂无评论