Publicar

A Xiaomi acabou de publicar algo que os laboratórios normalmente mantêm escondido: a verdadeira fatura do RL.


Tanto o MiMo-V2.6 Pro como o Flash foram treinados com 753k amostras e pararam no passo 30.
> O Pro custou $2.62M.
> O Flash custou $854k.
Esse gasto adicional 3.1x maior comprou 6.89 pontos no DeepSWE.
Depois, o Flash ainda superou o Pro no AutomationBench.
Já se começa a ver a mesma configuração de produto a surgir em todo o lado: um modelo para as tarefas absolutamente mais difíceis e outro logo abaixo, suficientemente barato para funcionar o dia inteiro.
A ZAI, a Deepseek, a Qwen e a Xiaomi têm agora todas isto em comum.
Assim que o modelo mais pequeno ultrapassa o nível de fiabilidade necessário para a maioria das tarefas, o modelo maior começa a parecer mais algo que se utiliza seletivamente, em vez de ser a opção predefinida para tudo.
É provável que essa acabe por ser a verdadeira arquitetura de modelos: inteligência barata por baixo, e inteligência dispendiosa acionada apenas quando a tarefa realmente a justifica.
Ver original
Esta página pode conter conteúdos de terceiros, que são fornecidos apenas para fins informativos (sem representações/garantias) e não devem ser considerados como uma aprovação dos seus pontos de vista pela Gate, nem como aconselhamento financeiro ou profissional. Consulte a Declaração de exoneração de responsabilidade para obter mais informações.
DEEPSEEKDEEPSEEK-1,58%

  • 1

Adicionar um comentário
Adicionar um comentário

Comentar
GateUser-67882efc
há 4 horas
Entrar com tudo 🚀
0Ver original
GateUser-67882efc
há 4 horas
Compre para ganhar 💎
0Ver original
GateUser-67882efc
há 4 horas
Mercado em alta 🐂
0Ver original
GateUser-67882efc
há 4 horas
Agarra-te firme 💪
0Ver original
haw81
há 6 horas
Primeira análise
Kosalana kosalana washa hawraman washa washington
0