أطلقت Moonshot AI أكبر نموذج ذكاء اصطناعي مفتوح المصدر من فئة Kimi K3 - ForkLog

AI-agents ИИ агенты 3# أطلقت Moonshot AI أكبر نموذج ذكاء اصطناعي مفتوح المصدر: Kimi K3

قدّمت شركة Moonshot AI الناشئة في الصين نموذج Kimi K3 — أول نموذج مفتوح المصدر من فئة 3T في العالم، بإجمالي 2.8 تريليون معلمة، ورؤية أصلية، وسياق حتى 1 مليون توكن. ووفق تقديرات المشروع الخاصة، في الترتيب العام لم تتفوّق عليها سوى النماذج الاحتكارية Claude Fable 5 وGPT 5.6 Sol.

تم بناء Kimi K3 على بنية جديدة اسمها Kimi Delta Attention (KDA) وAttention Residuals (AttnRes). تُمكّن KDA من معالجة تسلسلات البيانات الطويلة بكفاءة أكبر، بينما يستخرج AttnRes المعلومات المطلوبة ليس من جميع الطبقات بنفس القدر، بل بشكل انتقائي. ونتيجة لذلك، يفهم النموذج السياق بعمق أكبر ويُبقي المعنى حاضرًا حتى عند معالجة النصوص المعقدة.

أما بشأن التخفيف فيعتمد على إطار Stable LatentMoE: من بين 896 خبيرًا يعمل 16 فقط في الوقت نفسه. وقد أدى ذلك، بالتضافر مع بيانات جديدة وإعدادات تدريب جديدة، إلى رفع كفاءة التنفيذ بمعدل يبلغ ضعفين ونصف مقارنةً بـ K2.

ووفقًا لما ذكره المطورون، فقد حافظت نماذج Kimi على مدار الأشهر الـ12 الماضية (تسعة أشهر منها) على الرقم القياسي من حيث الحجم ضمن النماذج المفتوحة.

المصدر: مدونة Kimi. أصبح النموذج الجديد من Moonshot AI متاحًا الآن على الموقع، وفي Kimi Work وCode وAPI. وبشكل افتراضي تم تفعيل أقصى وضع للتفكير، وستظهر أوضاع أخرى لاحقًا. سيتم نشر الأوزان الكاملة والتقرير في 27 يوليو.

النتائج على بنشماركات

في جزء من الاختبارات، أظهرت K3 نتائج أعلى من Fable 5 وGPT-5.6 Sol، لكنها تراجعت بوضوح في اختبارات أخرى. تتصدر في SWE Marathon (42 مقابل 35 و39)، وBrowseComp (91.2 مقابل 88 و90.4)، وProgram Bench (77.8 مقابل 76.8 و77.6). أما في Terminal Bench 2.1 فتسجل K3 88.3 نقطة: أعلى من Fable 5 (84.6) وأقل بنقطة 0.5 فقط من Sol (88.8).

وفي الوقت نفسه، حققت K3 على FrontierSWE 81.2 مقابل 86.6 لدى Fable 5، وعلى HLE-Full 43.5 مقابل 53.3. وكانت منهجيات الاختبار مختلفة: تم تقييم بعض النماذج عبر Claude Code، بينما تم تقييم نماذج أخرى عبر Codex أو عبر KimiCode الخاص.

البرمجة ومهام الوكلاء

تستطيع K3 إجراء جلسات هندسية طويلة بمشاركة بشرية شبه معدومة، والتوجيه داخل مستودعات كبيرة، وإدارة أدوات الطرفية (terminal).

في اختبار تحسين نوى GPU الخاصة بالنموذج، عملت كل مهمة بشكل مستقل لمدة تصل إلى 24 ساعة على أربع مهام — بما في ذلك نوى AttnRes وKDA وMLA بعدد أبعاد رأس 512 — على NVIDIA H200 وGPU من شركة أخرى. وأظهرت K3 أداءً على مستوى Fable 5، وتقدمت بشكل ملحوظ على Opus 4.8 وGPT-5.6 Sol وGPT-5.5. وفي المراحل اللاحقة من التطوير، نفّذت نسخة مبكرة من K3 داخل فريق Moonshot غالب تحسينات هذا النوع بنفسها.

المصدر: مدونة Kimi. وبشكل منفصل، كتب النموذج من الصفر MiniTriton — مُجمّعًا مدمجًا لنوى GPU مع طبقة IR خاصة فوق MLIR، وتوليد كود PTX.

تصميم الشرائح وتطوير الألعاب

بصفته عرضًا توضيحيًا، صممت K3 من تلقاء نفسها شريحة لشبكة عصبية على بنية خاصة.

استغرق التشغيل الذاتي 48 ساعة: استخدم النموذج أدوات EDA مفتوحة المصدر ومكتبة Nangate 45 nm. احتلت الشريحة مساحة 4 مم²، وتحافظ على تردد 100 ميغاهرتز، وتصدر أكثر من 8700 توكن في الثانية في المحاكاة. وتتضمن 1.46 مليون خلية قياسية، و0.277 ميغابايت SRAM، ومصفوفة INT4 MAC مع فك تكميم (dequantization) مدمج.

كما تجمع K3 بين الاستدلال ثلاثي الأبعاد (3D) والبرمجة والرؤية لإنشاء نماذج أولية للألعاب والتفاعلات من مفاهيم وصور وفيديو.

العمل مع المعرفة والفيديو

في أحد الاستخدامات، أعادت K3 إنتاج العلاقات العامة I-Love-Q من الفيزياء الفلكية الحاسوبية. استغرق ذلك قرابة ساعتين بدلًا من أسبوع إلى أسبوعين عادةً لطالب بحث متمرس. تحققت النماذج من أكثر من 20 ورقة علمية، وقدّرت أكثر من 300 معادلة حالة، ووجدت تناقضات في الصيغ المنشورة، وكتبت أكثر من 3000 سطر كود بلغة Python، ثم نظمت النتيجة في لوحة معلومات HTML تفاعلية.

وفي حالة أخرى، أعدّت K3 تقريرًا تفاعليًا عن 42 عامًا من تاريخ صناعة رقائق ASIC خلال 120 جولة من التحسين الذاتي التكراري، عبر معالجة أكثر من 11 000 صفحة من 87 تقريرًا ربع سنويًا و99 ملف PDF أصلي.

المصدر: مدونة Kimi. بفضل العمل الأصلي مع الفيديو، تستطيع K3 تركيب المقاطع: في أحد الأمثلة، أنجزت النموذج رسومًا توضيحية تشرح معماريتها بأسلوب 3Blue1Brown؛ وفي مثال آخر، قامت بتركيب إعلان تشويقي عن إطلاقها من 56 مقطعًا خامًا، بما في ذلك اختيار اللقطات، والمزامنة مع الموسيقى، ومعالجة الصوت. وبتقدير Moonshot، كان سيستغرق هذا العمل لدى محرر فيديو متمرس يومًا إلى يومين، ولدى مبتدئ ثلاثة إلى خمسة أيام.

القيود

شدّدت مجموعة المشروع على أن K3 حساسة لفقدان سجل التفكير عند تبديل بيئة الوكيل في منتصف الجلسة، وقد تُظهر مبادرة مفرطة في المواقف الغامضة. ولجهة سهولة الاستخدام، تتأخر النماذج حاليًا بشكل ملحوظ عن Fable 5 وGPT-5.6 Sol.

للتذكير، في يوليو 2025 أطلقت Moonshot AI Kimi K2 — أول نموذج ضمن السلسلة بمعلمات تصل إلى 1 تريليون، والذي أصبح بسرعة واحدة من أبرز الأنظمة المفتوحة للأعمال الخاصة بالوكلاء.

NVDA%0.87
شاهد النسخة الأصلية
قد تحتوي هذه الصفحة على محتوى من جهات خارجية، يتم تقديمه لأغراض إعلامية فقط (وليس كإقرارات/ضمانات)، ولا ينبغي اعتباره موافقة على آرائه من قبل Gate، ولا بمثابة نصيحة مالية أو مهنية. انظر إلى إخلاء المسؤولية للحصول على التفاصيل.
  • أعجبني
  • تعليق
  • إعادة النشر
  • مشاركة
تعليق
إضافة تعليق
إضافة تعليق
لا توجد تعليقات
  • مُثبت