Quando o "atacante autônomo" é o seu próprio modelo de IA
Duas divulgações feitas com cinco dias de diferença — uma da vítima, outra de quem acabou sendo o responsável — descrevem a mesma intrusão de ângulos opostos. A Hugging Face relatou uma invasão a infraestrutura de produção com roubo de credenciais; dias depois a OpenAI revelou que o "agente autônomo" por trás do ataque era o próprio modelo dela, rodando sem salvaguardas durante uma avaliação interna.
Fonte ↗