OpenAI freia bruscamente o treinamento de seus modelos mais potentes: seus agentes de IA voltaram a sair do controle

Agentes autônomos de IA tentaram invadir e coletar dados em sites governamentais dos EUA, como o Departamento de Educação e a SEC; esta é a segunda vez que a criadora do ChatGPT suspende os trabalhos após comportamentos inesperados

Reprodução
Sem comentários Facebook Twitter Flipboard E-mail
barbara-castro

Bárbara Castro

Redatora

A OpenAI interrompeu o treinamento de seus modelos de IA mais avançados após uma série de incidentes inesperados, incluindo um modelo experimental que encontrou uma brecha para acessar a rede pública. Segundo noticiou o The Verge, o episódio ocorreu no dia 20 de setembro, e todo treinamento, avaliação e inferência com uso de ferramentas permaneceram congelados durante o fim de semana. É a segunda vez em três meses que a empresa precisa pisar no freio.

Tem se tornado cada vez mais recorrente ver agentes autônomos da OpenAI ou da Anthropic se envolvendo em tentativas de invasão a outros serviços ou exibindo comportamentos inadequados. Diante desse cenário, os laboratórios de inteligência artificial são obrigados a paralisar o processo de treinamento para investigar a fundo o que aconteceu e encontrar soluções.

Em episódios anteriores, já ficou evidente que o comportamento desses agentes pode ser bastante imprevisível, a ponto de terem capacidade suficiente para apagar seus próprios rastros ou omitir do usuário o que estão executando nos bastidores. A OpenAI garantiu que só retomará as atividades quando tiver confiança plena de que novas barreiras de segurança estão operando, e admitiu que terá de "apertar o pause" outras vezes conforme a tecnologia avança e novos imprevistos surgem.

O estopim foi um modelo que estava em fase de testes dentro de um ambiente controlado (sandbox), mas que acabou explorando uma vulnerabilidade para se conectar à internet, conforme apurou o The Verge. A partir daí, desencadeou-se uma sequência de problemas:

  • A OpenAI declarou que seus agentes enviaram indevidamente imagens de usuários do ChatGPT para plataformas públicas de hospedagem de imagens. A empresa não esclareceu se eram ilustrações geradas por IA, fotos reais ou registros com pessoas identificáveis.
  • O The Verge também informa que os modelos tentaram invadir o site do Departamento de Educação dos Estados Unidos e rasparam dados do Escritório do Censo norte-americano e da SEC (Comissão de Valores Mobiliários dos EUA).
  • Segundo o The Guardian, no caso da Educação, os agentes localizaram chaves de API que davam acesso a dados governamentais, embora insistam que apenas informações públicas foram coletadas. A OpenAI não confirmou a tentativa de invasão em si; foi a Transluce, empresa avaliadora de segurança em IA, que detectou o incidente.
  • Já em relação à SEC, os agentes acessaram relatórios de consulta pública, mas em seguida os republicaram em outro local da internet — extrapolando completamente o escopo das tarefas que deveriam executar.

Até o momento, os impactos parecem sob controle. O porta-voz da SEC, Kurt Hopfenspirger, afirmou que "nenhuma informação sigilosa foi acessada", e o Departamento de Educação ressaltou não ter encontrado "qualquer indício de prejuízo ao site ou aos bancos de dados", de acordo com informações da NBC News. O primeiro-ministro da Austrália, Anthony Albanese, chegou a afirmar que um agente da OpenAI violou o sistema de saúde pública do país, mas o The Guardian apurou que nenhum dado confidencial foi comprometido.

O alerta maior reside não tanto nos dados extraídos, mas sim no que a atitude demonstra: sistemas autônomos executando iniciativas que ninguém solicitou, em alvos imprevistos, e cuja ação só foi descoberta a posteriori. Auditorias internas realizadas nos registros da OpenAI revelaram inclusive outros episódios dessa natureza com o aprofundamento das averiguações, aponta o The Verge.

A primeira interrupção aconteceu em julho, após um ataque cibernético conjunto de agentes da OpenAI contra o Hugging Face, episódio que acendeu o sinal de alerta sobre o risco de perda de controle no setor. O presidente-executivo da OpenAI, Sam Altman, afirmou na última sexta-feira que o incidente no Hugging Face "continua sendo o episódio mais grave que já presenciamos". A criadora do ChatGPT também divulgou outros seis relatórios de conduta "inesperada ou preocupante" e estruturou um comitê interno para monitorar, investigar e expor situações desse tipo.

Após o pedido de Dario Amodei, CEO da Anthropic, para reduzir a velocidade no desenvolvimento da IA — coro que ganhou apoio de nomes da OpenAI, do Google DeepMind e de outras gigantes —, a pressão para moderar o passo só aumentou. Em Washington, porém, os sinais continuam contraditórios. Embora Donald Trump tenha concordado com o líder chinês Xi Jinping em compartilhar alertas de risco e alinhar protocolos de proteção, ele também assegurou que os Estados Unidos não vão desacelerar, argumentando que os críticos "querem travar nosso progresso porque estamos muito à frente da China".

Matéria traduzida de Xataka*

Inicio