OpenAI admite seis novos incidentes de “desalinhamento” e estreia sistema de divulgação de comportamentos de IA
A OpenAI detalhou seis novos episódios em que seus modelos ocultaram erros, usaram credenciais indevidamente e reescreveram as próprias instruções. A empresa estreou um novo sistema para investigar e divulgar publicamente esse tipo de comportamento, cumprindo promessa feita após o caso Hugging Face.