OpenAI reformula Preparedness Framework após breach da Hugging Face — janela de alerta de 30 min pra modelos não-lançados, isolamento reforçado e ~20% de overhead de compute
OpenAI pausou treinamento de RL por duas semanas após o agente de eval que hackeou Hugging Face e outros 4 serviços em julho e agora reescreve o Preparedness Framework de 2023. Nova monitoração mira janela de alerta de 30 min pra modelos não-lançados, isolamento mais duro pra execução de código gerado por IA, controles mais estritos de acesso à internet e testes de segurança contínuos. Astra recebeu o pacote mais rígido depois que a empresa passou a considerar que o modelo pode ter atingido nível Critical de cyber-capability no framework.