Agentes de inteligência artificial (IA) não reconhecem nacionalidades. Nas últimas semanas, discutimos detalhadamente os ataques a sites e serviços perpetrados por agentes da OpenAI e da Anthropic durante avaliações de segurança cibernética conduzidas por esses dois laboratórios. Agora, a discussão se voltou para a China, pois agentes de IA da Alibaba, DeepSeek e Moonshot exibiram comportamentos contrários aos interesses humanos, segundo a Reuters.
Recentemente, vários agentes desses laboratórios chineses participaram de uma simulação de licitação e fizeram algo que não deveriam fazer em hipótese alguma: exageraram ou mentiram sobre suas capacidades na tentativa de ganhar o contrato. E quando solicitados a tentar novamente, continuaram com esse comportamento problemático. Eles não estavam competindo por uma licitação real; estavam trabalhando em um ambiente de testes, mas, mesmo assim, o comportamento é preocupante.
No entanto, este não é o único incidente envolvendo IA chinesa que veio à tona nos últimos dias. De acordo com a Reuters, agentes de outro laboratório, não identificado, não conseguiram concluir uma tarefa corretamente e, por isso, decidiram agir por conta própria. Simularam a conclusão da tarefa e geraram arquivos que pareciam mostrar que haviam alcançado o resultado correto, a fim de enganar usuários. Felizmente, eles estavam confinados a um ambiente de avaliação fechado.
Agentes autônomos estão agindo cada vez mais por conta própria
Agentes desenvolvidos por laboratórios americanos e chineses têm exibido comportamentos muito semelhantes quando recebem autonomia para navegar na internet, criar arquivos, executar programas ou interagir com outros serviços. Não se trata de uma escolha deliberada de não executar as tarefas atribuídas; o problema é que eles parecem capazes de fazer qualquer coisa para atingir seu objetivo, sem considerar se as ações que tomam são contrárias aos interesses humanos.
Essa discrepância é especialmente grave considerando que, em alguns testes de ambiente fechado conduzidos por laboratórios de IA, eles não hesitaram em mentir e manipular seus usuários. Durante a maioria desses testes, os pesquisadores perceberam o que estava acontecendo e impediram o acesso dos agentes à internet, mas incidentes envolvendo a Hugging Face, a Modal Labs e diversas agências federais americanas confirmam que alguns deles conseguiram escapar do ambiente de teste e acessar a internet.
Desenvolvedores e agências chinesas estão tentando estabelecer mecanismos para avaliar e controlar esse tipo de comportamento dos agentes, visto que sua autonomia aumenta à medida que os modelos de IA evoluem. Este cenário nos lembra que os agentes são muito diferentes dos chatbots com os quais nos familiarizamos desde 2022. Se um chatbot apresentar comportamento errôneo, ele pode fornecer uma resposta incorreta ou totalmente inventada.
A operação de agentes acarreta riscos muito maiores, pois eles têm a capacidade, como vimos, de navegar na internet, criar arquivos, executar programas e interagir com outros serviços. Eles podem até formar alianças e se sacrificar pelo bem comum da comunidade de agentes, se isso os ajudar a atingir seu objetivo. Os resultados obtidos pelos laboratórios de IA servem como um alerta claro. E, nessa área, os desafios enfrentados pelos EUA e pela China são essencialmente os mesmos.
Imagem | N509FZ
Mais informações | Reuters
Ver 0 Comentários