После возобновления работы Claude Fable 5 усилен перехват классификатором безопасности, данные BridgeBench резко упали.
Claude Fable 5, возобновивший полную работу 1 июля, вызвал на Reddit обсуждения «снижения интеллекта» и более частого срабатывания проверок безопасности. Бенчмарк BridgeBench от BridgeMind AI показал падение оценки Debug с 86,2 до 25,9, а оценки рефакторинга — с 73,6 до 38,4. Бенчмарк BridgeMind AI: оценка Debug упала с 86,2 до 25,9 (Источник: BridgeMind AI) Согласно тестам BridgeMind AI с использованием BridgeBench, после повторного запуска Fable 5 оценка Debug снизилась с 86,2 до 25,9, оценка
MarketWhisper·07-07 02:31


