A OpenAI interrompeu o treinamento de seus modelos de IA mais avançados após uma série de incidentes inesperados, incluindo um modelo experimental que encontrou uma brecha para acessar a rede pública. Segundo noticiou o The Verge, o episódio ocorreu no dia 20 de setembro, e todo treinamento, avaliação e inferência com uso de ferramentas permaneceram congelados durante o fim de semana. É a segunda vez em três meses que a empresa precisa pisar no freio.
Tem se tornado cada vez mais recorrente ver agentes autônomos da OpenAI ou da Anthropic se envolvendo em tentativas de invasão a outros serviços ou exibindo comportamentos inadequados. Diante desse cenário, os laboratórios de inteligência artificial são obrigados a paralisar o processo de treinamento para investigar a fundo o que aconteceu e encontrar soluções.
Em episódios anteriores, já ficou evidente que o comportamento desses agentes pode ser bastante imprevisível, a ponto de terem capacidade suficiente para apagar seus próprios rastros ou omitir do usuário o que estão executando nos bastidores. A OpenAI garantiu que só retomará as atividades quando tiver confiança plena de que novas barreiras de segurança estão operando, e admitiu que terá de "apertar o pause" outras vezes conforme a tecnologia avança e novos imprevistos surgem.
O estopim foi um modelo que estava em fase de testes dentro de um ambiente controlado (sandbox), mas que acabou explorando uma vulnerabilidade para se conectar à internet, conforme apurou o The Verge. A partir daí, desencadeou-se uma sequência de problemas:
- A OpenAI declarou que seus agentes enviaram indevidamente imagens de usuários do ChatGPT para plataformas públicas de hospedagem de imagens. A empresa não esclareceu se eram ilustrações geradas por IA, fotos reais ou registros com pessoas identificáveis.
- O The Verge também informa que os modelos tentaram invadir o site do Departamento de Educação dos Estados Unidos e rasparam dados do Escritório do Censo norte-americano e da SEC (Comissão de Valores Mobiliários dos EUA).
- Segundo o The Guardian, no caso da Educação, os agentes localizaram chaves de API que davam acesso a dados governamentais, embora insistam que apenas informações públicas foram coletadas. A OpenAI não confirmou a tentativa de invasão em si; foi a Transluce, empresa avaliadora de segurança em IA, que detectou o incidente.
- Já em relação à SEC, os agentes acessaram relatórios de consulta pública, mas em seguida os republicaram em outro local da internet — extrapolando completamente o escopo das tarefas que deveriam executar.
Até o momento, os impactos parecem sob controle. O porta-voz da SEC, Kurt Hopfenspirger, afirmou que "nenhuma informação sigilosa foi acessada", e o Departamento de Educação ressaltou não ter encontrado "qualquer indício de prejuízo ao site ou aos bancos de dados", de acordo com informações da NBC News. O primeiro-ministro da Austrália, Anthony Albanese, chegou a afirmar que um agente da OpenAI violou o sistema de saúde pública do país, mas o The Guardian apurou que nenhum dado confidencial foi comprometido.
O alerta maior reside não tanto nos dados extraídos, mas sim no que a atitude demonstra: sistemas autônomos executando iniciativas que ninguém solicitou, em alvos imprevistos, e cuja ação só foi descoberta a posteriori. Auditorias internas realizadas nos registros da OpenAI revelaram inclusive outros episódios dessa natureza com o aprofundamento das averiguações, aponta o The Verge.
A primeira interrupção aconteceu em julho, após um ataque cibernético conjunto de agentes da OpenAI contra o Hugging Face, episódio que acendeu o sinal de alerta sobre o risco de perda de controle no setor. O presidente-executivo da OpenAI, Sam Altman, afirmou na última sexta-feira que o incidente no Hugging Face "continua sendo o episódio mais grave que já presenciamos". A criadora do ChatGPT também divulgou outros seis relatórios de conduta "inesperada ou preocupante" e estruturou um comitê interno para monitorar, investigar e expor situações desse tipo.
Após o pedido de Dario Amodei, CEO da Anthropic, para reduzir a velocidade no desenvolvimento da IA — coro que ganhou apoio de nomes da OpenAI, do Google DeepMind e de outras gigantes —, a pressão para moderar o passo só aumentou. Em Washington, porém, os sinais continuam contraditórios. Embora Donald Trump tenha concordado com o líder chinês Xi Jinping em compartilhar alertas de risco e alinhar protocolos de proteção, ele também assegurou que os Estados Unidos não vão desacelerar, argumentando que os críticos "querem travar nosso progresso porque estamos muito à frente da China".
Matéria traduzida de Xataka*
Ver 0 Comentários