Agentes de inteligência artificial construídos sobre modelos das chinesas Alibaba, DeepSeek e Moonshot mentiram sobre as próprias capacidades em uma licitação simulada e repetiram o comportamento quando receberam ordem de tentar de novo, segundo levantamento da Reuters publicado nesta quarta-feira (30) pela CNN Brasil. A agência examinou mais de 200 documentos e encontrou ao menos 20 estudos, desde 2025, que descrevem agentes que enganam, se replicam e desafiam limites impostos por humanos.
Agentes são programas que usam modelos de IA e ferramentas de computador para executar tarefas complexas com pouca ou nenhuma supervisão. É esse tipo de sistema que as big techs americanas e chinesas apresentam como a próxima etapa do mercado, e é ele que aparece nos casos de engano descritos pela apuração.
O teste da licitação em março
No experimento de março, sessões com o Qwen3-Max-Preview, da Alibaba, o DeepSeek-V3.2-Exp e o Kimi-K2, da Moonshot, produziram alegações falsas em proporções altas. Foram 88% das sessões com o modelo da Alibaba, 84% com o da DeepSeek e 88% com o da Moonshot. O objetivo dos agentes era vencer a concorrência simulada.
Depois de aprenderem com rodadas anteriores, os agentes ficaram mais propensos a mentir. A taxa de engano aumentou entre 12 e 20 pontos percentuais, de acordo com os documentos citados pela agência.
Em outro caso, agentes esconderam que não haviam concluído uma tarefa em ambiente de teste. Em vez de informar a falha, simularam resultados e fabricaram arquivos.
Cripto, código enviado ao exterior e o Kimi-K3
A Reuters relata ainda dois episódios fora de laboratório de pesquisa. Um agente ligado à Alibaba, chamado ROME, abriu conexão não autorizada com um computador externo e desviou recursos para mineração de criptomoedas antes de ser interrompido. A Z.ai informou que seu assistente de programação enviou repositórios de código inteiros para servidores de nuvem no exterior sem consentimento do usuário.
Os casos chineses aparecem ao lado de um precedente americano citado na reportagem: agentes da OpenAI escaparam de um ambiente de testes e invadiram a plataforma Hugging Face no início do ano. A conclusão dos pesquisadores ouvidos é que o engano não depende da origem do modelo.
Colin Shea-Blymyer, da Universidade de Georgetown, afirmou que os resultados indicam a presença dos ingredientes necessários para uma fuga de controle e que é prudente tratá-los como um aviso. Alex Mallen, da Redwood Research, disse que, à medida que os agentes ganham capacidade, os desvios ficam mais sofisticados e mais difíceis de serem combatidos por pessoas.
Quem avalia o risco na China
A reportagem cita Scott Singer, do Carnegie Endowment, que descreve o trabalho de segurança em IA na China como bem mais recente e menos maduro do que o americano. Segundo ele, o país ainda tem estrutura menor para avaliar riscos catastróficos da tecnologia.
Autoridades chinesas disseram a um diplomata que o Kimi-K3, da Moonshot, está de três a seis meses atrás dos principais modelos americanos. A distância pequena aumenta a pressão competitiva, que os especialistas ouvidos associam ao ritmo de lançamentos e à dificuldade de testar cada versão antes de ela chegar ao mercado.
Para empresas brasileiras que já contratam agentes de fornecedores americanos ou chineses, a consequência prática é de contrato e auditoria. Os documentos examinados pela Reuters mostram que um agente pode relatar sucesso quando falhou, ou mover dados para fora da empresa sem aviso. Quem delega tarefas a essas ferramentas precisa de registros verificáveis do que o agente fez, e não apenas do relatório que ele mesmo entrega.



