#DeepSeekV4ProApproachingFable5


DeepSeek V4 Pro、Fable 5に接近:AI競争はもはや「誰が最も賢いか」だけではない

DeepSeek V4 Proの公式アップデートは、特にコーディング、推論、ツールの利用、エージェント型タスクの能力において、大きな飛躍を示している。複数のテストでは、その性能がClaude Fable 5のようなフロンティアモデルにますます近づいていることが示されているものの、すべてのベンチマークで結果が一様なわけではない。
しかし、最も重要な点は、単に「DeepSeekがFable 5にほぼ匹敵した」ということではない。
本当に変化しているのは、フロンティアクラスのAIインテリジェンスを手に入れるための価格だ。
性能差は縮小し、価値をめぐる競争はさらに激化
DeepSeek V4 Proは8月中旬、前バージョンから大幅に性能を向上させ、正式にプレビュー段階を終えた。Reutersが引用したArtificial Analysisの独立テストでは、このモデルはIntelligence Indexで53点を獲得し、V4 Flashの40点から上昇した。
一方、DeepSeekの公式評価データは、複雑なタスクにおける高い能力を示している。Maxモードでは、V4 ProはGPQA Diamondで90.1%、LiveCodeBenchで93.5%、Codeforcesで3,206のレーティングなどを記録した。しかし、他のベンチマークでは、すべてのカテゴリーで絶対的に勝利するモデルは存在しないことが依然として示されている。
これがAI競争における重要な変化だ。
最も優れたモデルと競合モデルとの差はますます縮小する一方、コストとアクセス性の違いが、より決定的な要素になり得る。
もはや単なるチャットボットではなく、仕事をこなすエージェント
DeepSeekはAIエージェントの能力にも注力している。AIエージェントは質問に答えるだけでなく、ツールを使用し、複数のステップからなるプロセスを実行し、より複雑なタスクを完了できる。同時に、V4 Proのアップデートに伴い、DeepSeekはエージェント型ソフトウェアDeepSeek Harnessもオープンソースとして公開した。

つまり、次の競争はおそらく次のようなものではない。
「最も優れた回答を提供するAIはどれか?」
むしろ次のようになる。
「現実の仕事を最も効果的に完了できるAIはどれか?」
結論
DeepSeek V4 Proは、すべてのテストでFable 5を自動的に上回ったわけではない。実際、最新の報告では、複数の評価において依然としてこのモデルに遅れを取っていることが示されている。
しかし、だからこそ重要なのだ。
より安価でオープンなモデルがフロンティアのプレイヤーに近い能力を発揮できるようになると、AI市場は新たな段階に入る。優位性はもはや、最高のベンチマークスコアだけで決まるのではなく、性能、コスト、速度、アクセス性、そして現実の仕事を遂行する能力の組み合わせによって決まる。
DeepSeek V4 Proは、まだ競争全体に勝利したわけではない。しかし、競争のルールを変えることには貢献している。最高のAIが、必ずしも最も高価である必要はない。
原文表示
このページには第三者のコンテンツが含まれている場合があり、情報提供のみを目的としております(表明・保証をするものではありません)。Gateによる見解の支持や、金融・専門的な助言とみなされるべきものではありません。詳細については免責事項をご覧ください。
891回再生
  • 報酬
  • コメント
  • リポスト
  • 共有
コメント
コメントを追加
コメントを追加
コメントなし