Esta ronda de redução de custos e aumento de eficiência da OpenAI é brutal, os GPUs foram reduzidos para metade e os custos diretamente cortados ao meio, a corrida armamentista da infraestrutura de IA vai mudar.

Ver original
CoinNetwork
Notícias do Coin World, a OpenAI encontrou recentemente um conjunto de soluções de otimização capazes de reduzir os custos de inferência dos modelos em mais de metade. De acordo com uma fonte informada, engenheiros da OpenAI disseram a alguns colegas no início deste mês que, com base em várias novas tecnologias de otimização desenvolvidas, conseguiram reduzir o número necessário de GPUs da NVIDIA para apenas algumas centenas, especialmente após aplicar esta tecnologia no cenário de visitantes que usam o ChatGPT sem contas gratuitas ou pagas.
Esta página pode conter conteúdos de terceiros, que são fornecidos apenas para fins informativos (sem representações/garantias) e não devem ser considerados como uma aprovação dos seus pontos de vista pela Gate, nem como aconselhamento financeiro ou profissional. Consulte a Declaração de exoneração de responsabilidade para obter mais informações.
  • Recompensa
  • Comentar
  • Republicar
  • Partilhar
Comentar
Adicionar um comentário
Adicionar um comentário
Nenhum comentário
  • Fixado