تخطط غوغل لدمج بنية Gemini في الشرائح، مع تحسين كفاءة الاستدلال بأعلى معدل يصل إلى 10 أضعاف

robot
إنشاء الملخص قيد التقدم
[ME AI] () رسالة، وفقاً لمراقبة رصد Beating، تم الكشف أن غوغل تعمل على تطوير شريحة استدلال ذكاء اصطناعي Frozen v2. ستقوم بتثبيت جزء من بنية Gemini مباشرة داخل الشريحة، ما يقلل من الحسابات ونقل البيانات أثناء تشغيل النموذج. داخلياً، يُتوقع أن يصل عدد الرموز (Token) التي يمكنها معالجتها لكل واط إلى 6 إلى 10 أضعاف أحدث TPU. تخطط غوغل لنشرها في موعد أقصاه 2028. تسعى غوغل إلى استخدامها لتخفيف نقص القدرة الحاسوبية. وقد أجبر هذا النقص Google Cloud على رفض بعض طلبات العملاء الخارجيين. سيظل Frozen v2 موجوداً بالتوازي مع TPU. يمكن لـ TPU تشغيل نماذج مختلفة، بينما يستبدل Frozen v2 المرونة بالكفاءة. وهذه أيضاً مقامرة معمارية. إذا أجرت Gemini لاحقاً تعديلاً كبيراً على التصميم الأساسي، فقد لا تتمكن هذه الدفعة من الشرائح من الاستمرار في الاستخدام. (المصدر: BlockBeats)
شاهد النسخة الأصلية
قد تحتوي هذه الصفحة على محتوى من جهات خارجية، يتم تقديمه لأغراض إعلامية فقط (وليس كإقرارات/ضمانات)، ولا ينبغي اعتباره موافقة على آرائه من قبل Gate، ولا بمثابة نصيحة مالية أو مهنية. انظر إلى إخلاء المسؤولية للحصول على التفاصيل.
  • أعجبني
  • تعليق
  • إعادة النشر
  • مشاركة
تعليق
إضافة تعليق
إضافة تعليق
لا توجد تعليقات
  • مُثبت