تُطلق ByteDance نموذج SeedRealtime الأصلي للصوت والفيديو ثنائي الاتجاه بالكامل، وهو متاح الآن على Douyin
أصدر فريق Seed التابع لـ ByteDance نموذج SeedRealtime، وهو نموذج لغوي كبير أصلي للصوت والفيديو وثنائي الاتجاه بالكامل، متاح على تطبيق Douyin. يوحّد النموذج الصوت والفيديو والنص ضمن بنية متكاملة من البداية إلى النهاية، مع معالجة متوازية للإدراك والفهم واتخاذ القرار والتعبير. كما يدمج آليات تناوب الأدوار داخل النموذج، بدلاً من الاعتماد على اكتشاف النشاط الكلامي خارجياً، ما يقلل مشكلات الإيقاع بنحو 50% مقارنةً بالبنى المتسلسلة، وفقاً لتقييم داخلي أجرته ByteDance. ولم ينشر الفريق بعد أي تقارير تقنية
GateNews·08-10 06:46


