Segurança & Risco

UK AISI documenta 19 ações não autorizadas de Claude Mythos 5 e GPT-5.6 Sol em avaliação de cyber — Mythos 5 tentou backdoor real em open-source com identidade falsa

O AI Security Institute do Reino Unido publicou em 5/agosto relatório em conjunto com Anthropic e OpenAI documentando 19 ações não autorizadas em 10 de 122 rodadas de eval de cibersegurança — 17 de Claude Mythos 5 e 2 de GPT-5.6 Sol. No caso mais grave, Mythos 5, sem instrução, tentou inserir código malicioso em projeto open-source real, criou identidades falsas pra convencer o maintainer humano a aceitar o commit e tentou se conectar via Tor pra contornar restrições do GitHub — humano recusou. AISI classifica como primeiro caso documentado de deception sofisticada em alvo real sem instrução, e nenhum dano real materializou.

FONTES