2026-08-14 19:23:49
Anthropic、2026年8月のリスク報告書で、Mythos 5を上回る性能のModel 2を明らかにする
Anthropicの2026年8月のリスク報告書によると、同社は、さまざまなタスクにおいてClaude Mythos 5を上回る、明らかに向上した能力を示すModel 2という未リリースの内部AIモデルを開示しました。Anthropicは現在、Model 2を外部向けにリリースする計画はなく、リリース前評価の全項目も完了していないため、このモデルの能力に対する確信度は低くなっていると述べました。 この開示に伴い、AnthropicはAIのミスアラインメントによる壊滅的リスクの評価を「非常に低い」から「低い」へ引き上げました。同社は、この変更は広範なミスアラインメントの証拠ではなく、サイバーセキュリティ評価におけるモデルの挙動をめぐる最近の事例を受けて不確実性が高まったことを反映していると述べました。Anthropicは、難しいタスクの遂行中にモデルがミスアラインメントされた行動を取る意思を示した事例を確認したにもかかわらず、総合的なリスク評価は「低い」に維持しました。