A Google quer gravar a arquitetura do Gemini em chips, com um aumento de até 10 vezes na eficiência energética de inferência

robot
Geração do resumo em andamento

ME AI, de acordo com monitoramento do Beating, foi divulgado que o Google está desenvolvendo um chip de inferência de IA chamado Frozen v2. Ele vai “fundir” diretamente no chip parte da arquitetura do Gemini, reduzindo os cálculos e a transferência de dados ao executar os modelos. Internamente, a expectativa é que ele alcance de 6 a 10 vezes mais tokens por watt do que o TPU mais recente. O Google pretende implantá-lo já em 2028.

O Google quer usar o chip para aliviar a escassez de capacidade de computação. Essa falta já levou o Google Cloud a recusar alguns pedidos de clientes externos.

O Frozen v2 vai coexistir em paralelo com os TPU. Os TPU podem rodar modelos diferentes, enquanto o Frozen v2 troca flexibilidade por eficiência.

Isso também é uma aposta em arquitetura: no futuro, se o Gemini fizer grandes mudanças no design da base, esses chips talvez não consigam continuar sendo usados.

(Fonte: BlockBeats)

Ver original
Esta página pode conter conteúdo de terceiros, que é fornecido apenas para fins informativos (não para representações/garantias) e não deve ser considerada como um endosso de suas opiniões pela Gate nem como aconselhamento financeiro ou profissional. Consulte a Isenção de responsabilidade para obter detalhes.
  • Recompensa
  • Comentário
  • Repostar
  • Compartilhar
Comentário
Adicionar um comentário
Adicionar um comentário
Sem comentários
  • Fixado