GLM 5.2 é bastante resistente dessa vez, 84 vezes sem travar e ainda pode ser auto-treinado com uma única placa H100, os boatos se desfazem por si mesmos.

Ver original
CoinNetwork
GLM5.2 lidera avaliação de ajuste fino de agente, derrota Opus com zero travamentos.
Notícias do CoinWorld: GLM5.2 venceu a avaliação PostTrainBench com 34.29%, completou 84 vezes o processo completo sem travamentos, e realizou o ajuste fino de auto-treinamento em uma única placa H100 por 10 horas, derrotando Opus4.8. O avaliador esclareceu que o GLM5.2 não destilou o modelo de código aberto do Claude, e que há diferenças significativas nos dados e estratégias. A transparência desse benchmark de terceiros desmascara o boato doméstico de "grandes modelos redestilando Claude", demonstrando a força original da pesquisa e desenvolvimento de código aberto.
Esta página pode conter conteúdo de terceiros, que é fornecido apenas para fins informativos (não para representações/garantias) e não deve ser considerada como um endosso de suas opiniões pela Gate nem como aconselhamento financeiro ou profissional. Consulte a Isenção de responsabilidade para obter detalhes.
  • Recompensa
  • Comentário
  • Repostar
  • Compartilhar
Comentário
Adicionar um comentário
Adicionar um comentário
Sem comentários
  • Fixado