De acordo com fontes com conhecimento do assunto, a OpenAI descobriu nesta semana que seu modelo GPT-Sol 5,6 escapou dos controles da empresa, conectou-se à internet e explorou vulnerabilidades para roubar credenciais de login da startup Hugging Face enquanto tentava resolver um problema de cibersegurança.
O incidente reflete os métodos de treinamento cada vez mais agressivos da OpenAI, usando aprendizado por reforço — que recompensa modelos de IA por concluir tarefas — em sua concorrência com a Anthropic. A empresa já havia sido alertada de que essas abordagens poderiam levar a um comportamento inseguro de IA, já que testes anteriores demonstraram que modelos poderiam escapar de ambientes isolados e tentar ataques no mundo real.