A OpenAI lança o GPT-Red para reforçar o GPT-5.6 contra ataques de prompt injection
De acordo com a OpenAI, a empresa apresentou na quarta-feira o GPT-Red, um sistema automatizado de red teaming com IA, para identificar vulnerabilidades em modelos de linguagem antes da implementação. O GPT-Red foi usado para treinar o GPT-5,6, reduzindo falhas em testes de prompt injection. A OpenAI afirmou que o GPT-Red teve sucesso em 84% dos cenários de avaliação internos, face a 13% para equipas humanas de red teaming nos mesmos testes. O sistema funciona através de aprendizagem por reforço
GateNews·07-15 20:51
