Profundas noticias de TechFlow: el 25 de julio, Anthropic anunció que su modelo Opus 5 en escenarios de agentes inteligentes para navegadores es casi inmune a los ataques de inyección de prompts. En 129 escenarios de prueba, la tasa de éxito de los ataques fue cero; en las pruebas de inyección de prompts de Gray Swan, tras 15 intentos, la tasa de éxito bajó del 5,5% de Opus 4.8 al 2,0%. El 0% de éxito solo se logró cuando se habilitó el Auto Mode en productos como Claude Cowork, un modo que combina dos capas de defensa: análisis de entradas e interceptación de la ejecución. La inyección de prompts se considera una de las mayores amenazas de seguridad a las que se enfrentan los agentes de IA; esta mejora podría marcar que el problema se mitiga de forma efectiva en determinados escenarios.

Ver original
Esta página puede contener contenido de terceros, que se proporciona únicamente con fines informativos (sin garantías ni declaraciones) y no debe considerarse como un respaldo por parte de Gate a las opiniones expresadas ni como asesoramiento financiero o profesional. Consulte el Descargo de responsabilidad para obtener más detalles.
  • Recompensa
  • Comentar
  • Republicar
  • Compartir
Comentar
Añadir un comentario
Añadir un comentario
Sin comentarios
  • Fijado