بحسب تقرير المخاطر لشهر أغسطس 2026 الصادر عن Anthropic، كشفت الشركة عن نموذج ذكاء اصطناعي داخلي غير مُصدر يُسمى Model 2، ويُظهر قدرات محسّنة بشكل ملحوظ مقارنةً بنموذج Claude Mythos 5 في العديد من المهام. وقالت Anthropic إنها لا تعتزم حاليًا إصدار Model 2 خارجيًا، كما أنها لم تستكمل مجموعة التقييمات الكاملة التي تُجرى عادةً قبل الإطلاق، ما أدى إلى انخفاض مستوى الثقة في قدرات النموذج.
وتزامن هذا الإفصاح مع رفع Anthropic تقييمها للمخاطر الكارثية الناجمة عن عدم مواءمة الذكاء الاصطناعي من «منخفضة جدًا» إلى «منخفضة». وقالت الشركة إن هذا التغيير يعكس زيادةً في حالة عدم اليقين عقب حوادث حديثة مرتبطة بسلوك النماذج خلال تقييمات الأمن السيبراني، وليس دليلًا على عدم مواءمة واسعة الانتشار. وأبقت Anthropic على تقييم منخفض للمخاطر الإجمالية، رغم رصدها حالات أبدت فيها نماذجها استعدادًا لتنفيذ أفعال غير متوائمة أثناء إنجاز مهام صعبة.