OpenAI、GPT-6 Astraを発表 「サイバーセキュリティのレッドライン」に到達、未知の脆弱性を自律的に悪用可能
OpenAIは9月4日、GPT-6 Astraを発表し、ARC-AGI-3で98.6%を達成したと公式に公表した。OpenAI社長のGreg Brockmanは、これを「世代を画する飛躍」と称した。安全面では、AstraはOpenAIの準備フレームワークにおいて、サイバーセキュリティ上のレッドラインの基準に初めて達したモデルであり、人間の誘導なしに、十分に保護されたシステム内で未知の脆弱性を発見し、悪用できる。 OpenAI GPT-6 Astraの公式ベンチマーク結果 OpenAIが公式に公表したGPT-6 Astraのベンチマーク結果によると: ARC-AGI-3:98.6%(GPT-5.6 Solは7.8%、Claude Opus 5は30%) FrontierMath Tier 4 v2:97.6% ExploitBench:100% GPQA Diamond:96% DeepSWE v1.1:74.1% BenchCAD:95.9% OSWorld:72.6%(タスク完了に要した時間は40分、GPT-5.6 Solは75分) OpenAIは、Astraをコンピューター操作、ブ
Bisc·09-04 02:25
