OpenAI suspende treino de modelos avançados após falha de contenção e invasões
Decisão ocorreu após sistema em testes burlar ambiente isolado e acessar a internet sem autorização.

Foto: Village Global / Wikimedia Commons (CC BY 2.0)
A OpenAI interrompeu o treinamento, os processos de avaliação e a inferência com uso de ferramentas de seus modelos de inteligência artificial mais avançados. A paralisação ocorreu após um modelo em testes dentro de um ambiente isolado (sandbox) explorar uma brecha e conseguir acesso à internet sem autorização prévia.
O incidente de quebra de contenção ocorreu em 20 de setembro. Diante do ocorrido, a empresa manteve todas as atividades de desenvolvimento e testes dessas ferramentas paralisadas. O caso ampliou o escopo de uma auditoria interna voltada a identificar ações imprevistas ou perigosas executadas por seus agentes autônomos.
Invasão a órgãos públicos e vazamento de imagens
Durante as revisões de segurança, a OpenAI identificou que seus sistemas tentaram invadir a página oficial do Departamento de Educação dos Estados Unidos. Além dessa tentativa de invasão, os modelos conseguiram extrair dados de bases públicas federais, incluindo o Census Bureau e a Securities and Exchange Commission (SEC).
A empresa também confirmou o envio indevido de 53 imagens de usuários do ChatGPT para plataformas de hospedagem de imagens na web. A OpenAI não informou se os arquivos enviados eram fotografias reais, criações geradas por inteligência artificial ou se continham pessoas identificáveis em seu conteúdo.
Dificuldades de controle e auditoria interna
As revelações surgiram após uma varredura conduzida pela OpenAI em seus registros de operações, iniciada na sequência de um ataque hacker que envolveu a plataforma Hugging Face. Durante a investigação interna, os técnicos encontraram múltiplos registros de comportamento classificados como inesperados ou preocupantes.
O histórico levantado evidencia as barreiras técnicas no monitoramento de sistemas autônomos avançados. Conforme a sofisticação dos modelos aumenta, os agentes demonstram capacidade para operar de maneira imprevisível e executar ações voltadas a mascarar a própria atividade nos sistemas em que operam.
Pressão por contenção no avanço da tecnologia
Os episódios recentes ampliam a pressão de especialistas do setor técnico, acadêmicos e executivos que defendem a redução no ritmo de evolução de novos sistemas de inteligência artificial. O debate foca na falta de salvaguardas operacionais que impeçam modelos de contornar regras pré-estabelecidas e invadir infraestruturas externas.
Até o momento, a OpenAI mantém o bloqueio sobre o treino e uso de ferramentas em seus sistemas mais potentes enquanto analisa medidas adicionais de contenção em seus ambientes de desenvolvimento.