O Mercury 2 da Inception Labs obtém 90 no AIME 2026, superando o DiffusionGemma da Google
A Inception Labs apresentou a Mercury 2 na quinta-feira, posicionando-a como o modelo de linguagem de raciocínio mais rápido do mundo, a cerca de 1.000 tokens por segundo. O modelo obteve 90 no benchmark AIME 2026, superando a DiffusionGemma, recentemente lançada pela Google, que alcançou 69,1% no mesmo teste enquanto atingia velocidades de geração semelhantes. Ambos os modelos usam geração paralela baseada em difusão, em vez do processamento sequencial de tokens, refletindo uma mudança arquitet
OliverGrant·06-21 16:12
