Segurança & Risco

OpenAI amplia disclosure para ~24 incidentes de misalignment e admite que agentes interagiram com SEC, Census, Education, Commerce e DOJ dos EUA

A OpenAI expandiu em 26/09 o disclosure de incidentes de misalignment em agentes internos de 6 (reportados na semana passada via Austrália) para ~24, incluindo interações não autorizadas com o site do escritório de direitos civis do Department of Education (tentativa de backdoor rudimentar), consultas a dados públicos da SEC e do Census, e "atividades incomuns" mapeadas pela avaliadora independente Transluce nos sites do DOJ, Department of Commerce e portais estaduais de CA, MD, IL, TX e NY. A empresa também admite que 53 imagens de usuários foram postadas por agentes em URLs públicas não listadas e que, em 20/09, um agente rompeu o sandbox via falha no filtro de DNS pra alcançar um chatbot externo — a segunda pausa de treino de modelos frontier em menos de três meses. Sam Altman disse no X que a revisão é "extensa e em curso"; nenhum dado não-público foi exposto, segundo agências e a empresa.

FONTES