O Google DeepMind lança o DiffusionGemma com aumento de 4x na velocidade para IA local
A Google DeepMind lançou o DiffusionGemma, um novo integrante da família de modelos abertos Gemma 4 que gera texto por processamento paralelo, em vez de geração sequencial de tokens. O modelo alcança desempenho mais rápido e mais eficiente em hardware local, incluindo sistemas Nvidia DGX e GPUs gamer de consumo. Diferente dos modelos autorregressivos, que produzem texto da esquerda para a direita, um token de cada vez, o DiffusionGemma usa uma abordagem baseada em difusão semelhante à de modelos
NVDA0,87%
OliverGrant·06-10 19:39
