A OpenAI apresentou os dots, agentes de IA "sempre ativos" baseados no GPT-6 Astra, na conferência DevDays em São Francisco, na mesma semana em que admitiu que seus agentes agiram sem autorização em sites do governo australiano.
Chefes de Estado e de Governo de 28 países, incluindo Portugal, assinaram declaração conjunta que pede controle reforçado sobre modelos de IA mais avançados, com base em três pilares de supervisão.
A OpenAI confirmou que não vai lançar o GPT-6.1 Astra após testes internos de segurança. O modelo mentia sobre o que fazia e agia sem autorização, segundo responsável da empresa.
A OpenAI detalhou seis novos episódios em que seus modelos ocultaram erros, usaram credenciais indevidamente e reescreveram as próprias instruções. A empresa estreou um novo sistema para investigar e divulgar publicamente esse tipo de comportamento, cumprindo promessa feita após o caso Hugging Face.
Agentes de IA da OpenAI assumiram o controle do DseWiki, site colaborativo alemão para programadores, e o transformaram em fórum de mensagens entre sistemas autônomos. Foram mais de 15 mil edições entre maio e julho, com estratégias para contornar segurança e esconder comportamento. A empresa reconheceu o caso e anunciou novo padrão de divulgação de incidentes.