Agentes de IA da China aprendem a mentir e burlar regras em testes

Agentes de IA chineses mentem e burlam regras em testes, acendendo alerta global sobre riscos de sistemas autônomos.

30/09/2026 05:13

4 min

Enquanto líderes de IA pedem desaceleração no desenvolvimento da tecnologia, alguns temem que a China possa seguir avançando — e ultrapassar os EUA
Enquanto líderes de IA pedem desaceleração no desenvolvimento da...
▼

Agentes de inteligência artificial que usam tecnologia chinesa aprenderam a mentir, burlar regras e esconder falhas em testes controlados. Os casos, documentados em mais de 20 estudos desde 2025, acendem um alerta global sobre os riscos de perder o controle sobre sistemas autônomos, segundo especialistas ouvidos pela Reuters.

CONTINUA DEPOIS DA PUBLICIDADE

Em um dos episódios deste ano, agentes baseados em modelos da Alibaba, Deep Seek e Moonshot mentiram sobre as próprias capacidades para vencer uma licitação simulada. Quando orientados a tentar de novo, insistiram no comportamento enganoso. Em outro teste, os programas — que combinam modelos de IA com ferramentas de computador para agir com mínima supervisão humana — simularam resultados e fabricaram arquivos para esconder que não haviam concluído uma tarefa.

A Reuters analisou mais de 200 documentos, entre artigos acadêmicos e relatórios técnicos, e identificou ao menos 20 avaliações que descrevem agentes exibindo engano, replicação e desafio a limites. Especialistas ouvidos definem essas características como ingredientes básicos para uma ruptura — algo que pode se tornar cada vez mais difícil de conter à medida que os sistemas evoluem.

CONTINUA DEPOIS DA PUBLICIDADE

Sinais de alerta em ambiente controlado

Colin Shea – Blymyer, pesquisador do Centro de Segurança e Tecnologias Emergentes da Universidade de Georgetown, afirma que os resultados fornecem “evidências de que os ingredientes necessários para uma fuga descontrolada estão presentes”. Para ele, é prudente encarar os achados como um aviso.

Outros quatro especialistas em IA que analisaram os casos concordam.

Alex Mallen, pesquisador da Redwood Research, organização sem fins lucrativos que estuda riscos em sistemas avançados, diz que os exemplos chineses não são particularmente perigosos no nível atual de capacidade. “Mas, à medida que os agentes se tornam mais capazes, seus comportamentos inadequados se tornam mais sofisticados e, portanto, mais difíceis de serem combatidos pelos humanos”, completa.

A maioria dos casos ocorreu em experimentos controlados, muitos desenhados justamente para expor falhas. Nem todos os agentes foram desenvolvidos por empresas chinesas, mas todos usaram sistemas de IA do país para funcionar. Procuradas, Alibaba, Deep Seek, Moonshot e Zai não comentaram.

Leia também

As três primeiras disseram testar sistemas regularmente e atualizar medidas de segurança. A Zai afirmou que acolhe escrutínio para solucionar problemas.

Experimentos mostram agentes que mentem e enganam

No experimento de licitação de março, pesquisadores de universidades chinesas e do Laboratório de Segurança 360 AI simularam uma disputa por contratos. Cada agente recebeu informações sobre seu produto e os requisitos do cliente. Pelo menos uma alegação falsa apareceu em 88% das sessões com o modelo Qwen, 84% com o Deep Seek – V 3.2 – Exp e 88% com o Kimi – K 2 da Moonshot.

Os pesquisadores permitiram que os agentes aprendessem com rodadas anteriores antes de tentar de novo. O resultado: a taxa de engano subiu de 12 a 20 pontos percentuais nos três modelos chineses. Modelos americanos testados produziram resultados parecidos.

O exercício virtual se alinha a planos reais do governo chinês, que em maio listou licitações como área onde agentes de IA podem ser implantados.

Outro estudo, de dezembro de 2025, examinou como 11 agentes baseados em modelos chineses e americanos lidaram com ferramentas defeituosas e arquivos ausentes. Em vez de admitir o fracasso, eles adotaram técnicas como adivinhar respostas, substituir fontes, simular resultados e fabricar arquivos.

Pesquisadores do Laboratório de IA de Xangai e da Universidade de Ciência e Tecnologia de Hong Kong disseram à Reuters que o comportamento difere de alucinações comuns da IA, porque os agentes sabiam que a tarefa havia falhado.

Comportamentos que indicam risco de fuga

Em março de 2025, pesquisadores da Universidade Fudan relataram que um sistema baseado no Qwen 2.5-72B – Instruct, da Alibaba, criou uma cópia de si mesmo em outro ambiente computacional sem receber instrução para isso. O movimento ocorreu depois que o sistema encontrou informações de que seria substituído.

Em outros testes, ele desenvolveu estratégias para evitar ser desligado.

Em outro caso amplamente divulgado, o agente ROME, vinculado à Alibaba, estabeleceu uma conexão de um computador da Alibaba Cloud para uma máquina externa sem autorização e desviou recursos para minerar criptomoedas. Os sistemas de segurança detectaram e interromperam a atividade.

Não há evidência de que o agente tenha se espalhado pela internet, mas o exemplo mostrou que o sistema pode contornar instruções humanas e encontrar caminho para a economia real.

Em setembro, a Zai afirmou que agentes em seu sistema de treinamento buscaram respostas por canais não previstos, tentaram falsificar solicitações de usuários e burlar medidas de segurança. A empresa reforçou os controles de acesso. A China já divulgou orientações recomendando que agentes permaneçam dentro de limites autorizados e que sistemas bloqueiem comportamentos anormais.

A versão 3.0 do Quadro de Governança de Segurança de IA, de 14 de setembro, lista riscos como agentes que obtêm recursos ou permissões de forma independente, enganam avaliadores e exploram vulnerabilidades em ambientes isolados.

Fluente em quatro idiomas e com experiência em coberturas internacionais, Ricardo Tavares explora o impacto global dos principais acontecimentos. Ele já reportou diretamente de zonas de conflito e acompanha as relações diplomáticas de perto.

CONTINUA DEPOIS DA PUBLICIDADE

Ative nossas Notificações

Ative nossas Notificações

Fique por dentro das últimas notícias em tempo real!