Evaluaciones independientes muestran que MiniMax M2.7 es comparable a los modelos líderes cerrados en tareas de agentes inteligentes centrales

robot
Generación de resúmenes en curso

Noticias de ME News: mensaje del 5 de abril (UTC+8). Recientemente, según una evaluación independiente de LangChain, el modelo de pesos abiertos MiniMax M2.7 ha alcanzado un nivel comparable al de los modelos punteros de código cerrado en tareas fundamentales de agentes, como operaciones con archivos, llamadas a herramientas y seguimiento de instrucciones. El artículo sostiene que su ventaja radica en que reduce los costes de forma significativa, aproximadamente 20 veces, y aumenta la velocidad entre 2 y 4 veces. Tomando como ejemplo una salida diaria de 10 millones de tokens, el coste de usar Opus 4.6 es de aproximadamente 250 dólares al día, mientras que MiniMax M2.7 solo requiere alrededor de 12 dólares al día. Este avance se debe al impulso de evaluaciones abiertas como SWE-Rebench y Terminal Bench 2.0, que hacen que los modelos abiertos sean una opción viable para desplegar agentes en entornos de producción y que además puedan utilizarse en colaboración con modelos de código cerrado. (Fuente: InFoQ)

Ver originales
Esta página puede contener contenido de terceros, que se proporciona únicamente con fines informativos (sin garantías ni declaraciones) y no debe considerarse como un respaldo por parte de Gate a las opiniones expresadas ni como asesoramiento financiero o profesional. Consulte el Descargo de responsabilidad para obtener más detalles.
  • Recompensa
  • Comentar
  • Republicar
  • Compartir
Comentar
Añadir un comentario
Añadir un comentario
Sin comentarios
  • Anclado