Google DeepMind publie DiffusionGemma avec un gain de vitesse 4x pour l’IA locale
Google DeepMind a publié DiffusionGemma, un nouvel élément de la famille de modèles open Gemma 4 qui génère du texte via un traitement parallèle plutôt que par génération séquentielle de jetons. Le modèle obtient des performances plus rapides et plus efficaces sur du matériel local, y compris les systèmes Nvidia DGX et les GPU gaming grand public. Contrairement aux modèles autorégressifs qui produisent du texte de gauche à droite, un jeton à la fois, DiffusionGemma utilise une approche basée sur
NVDA1,30 %
OliverGrant·06-10 19:39
