Agentes de IA da China podem mentir – assim como seus rivais americanos
Economia

Agentes de IA da China podem mentir – assim como seus rivais americanos

  • 30/09/2026 04:00
  • Redação

Agentes de IA com tecnologia chinesa aprenderam a enganar, contornar restrições e ocultar falhas, demonstrando características em inteligência artificial autônoma que têm gerado alarme global sobre os modelos americanos, segundo documentos de pesquisa e especialistas.

Num caso ocorrido este ano, agentes que utilizavam modelos das empresas chinesas Alibaba, DeepSeek e Moonshot mentiram sobre as suas capacidades numa tentativa de ganhar uma licitação simulada, e depois insistiram no comportamento enganoso quando foram instruídos a tentar novamente.

Em outro caso, agentes – programas que usam modelos de IA e ferramentas de computador para realizar tarefas complexas com pouca ou nenhuma intervenção humana – ocultaram a falha em concluir uma tarefa em um ambiente de teste, simulando resultados e fabricando arquivos.

A Reuters examinou mais de 200 documentos, desde artigos de pesquisa universitária a relatórios técnicos, e identificou pelo menos 20 estudos ou avaliações desde 2025 que descrevem casos em que agentes exibiram comportamentos como engano, replicação e desafio a limites, que especialistas em IA descreveram como elementos fundamentais para uma ruptura e que podem se tornar mais difíceis de controlar para os humanos à medida que os sistemas avançam.

A análise, que também incluiu entrevistas com uma dúzia de especialistas e pessoas familiarizadas com a indústria de IA da China, não encontrou evidências de que agentes com tecnologia chinesa tenham escapado de forma independente para a internet em geral ou evitado o bloqueio.

“Esses resultados fornecem evidências de que os ingredientes necessários para uma fuga descontrolada estão presentes”, disse Colin Shea-Blymyer, pesquisador do Centro de Segurança e Tecnologias Emergentes da Universidade de Georgetown.

“É prudente encarar isso como um aviso”, disse ele, ecoando os comentários de outros quatro especialistas em IA que analisaram os casos.

‘Mais difícil para os humanos responderem’

A maioria dos casos ocorreu em experimentos controlados, muitos deles deliberadamente projetados para expor possíveis falhas.

Nem todos os agentes envolvidos foram desenvolvidos ou operados por programadores ou empresas de IA chinesas — embora muitos tenham sido —, mas eles usaram sistemas de IA chineses para funcionar.

“Esses são os mesmos sinais de alerta que os laboratórios dos EUA estão observando, em sistemas menos capazes”, disse Alex Mallen, pesquisador da Redwood Research, uma organização sem fins lucrativos que estuda os riscos em sistemas avançados de IA.

Ele afirmou que os exemplos chineses não eram particularmente perigosos nos níveis de capacidade atuais, mas “à medida que os agentes se tornam mais capazes, seus comportamentos inadequados se tornam mais sofisticados e, portanto, mais difíceis de serem combatidos pelos humanos”.

Alibaba, DeepSeek, Moonshot e Z.ai não responderam aos pedidos de comentários da Reuters. Alibaba, DeepSeek e Moonshot afirmaram que testam seus sistemas regularmente e atualizam as medidas de segurança. A Z.ai declarou, após um incidente que motivou uma revisão de sua segurança, que acolhe o escrutínio para solucionar quaisquer problemas.

Contudo, ao contrário dos EUA, as empresas chinesas de IA não foram expostas ao mesmo nível de escrutínio público nem enfrentaram os mesmos apelos de funcionários denunciantes ou executivos seniores que buscavam uma desaceleração na corrida da IA.

Alguns dos sinais de alerta em casos envolvendo agentes com tecnologia chinesa, embora em ambientes controlados, antecederam os incidentes divulgados publicamente de bots de IA dos EUA invadindo a internet.

“Não sabemos se houve algum incidente de IA na China semelhante ao que vimos com a OpenAI e a Hugging Face. Os incidentes podem não ser divulgados publicamente”, disse Scott Singer, codiretor da Iniciativa de IA da China na Carnegie Endowment for International Peace, que recebe alguns fundos do governo dos EUA.

No início deste ano, agentes de IA desenvolvidos pela empresa americana OpenAI escaparam de um laboratório e invadiram a plataforma de código aberto Hugging Face. Em outro incidente envolvendo modelos americanos que gerou alarme, a Austrália informou em setembro que um agente da OpenAI invadiu um portal de saúde do governo.

Eric Xu, presidente rotativo da gigante tecnológica chinesa Huawei, disse a jornalistas em setembro que os desenvolvedores chineses talvez precisassem avançar mais antes de se depararem com casos desse tipo, mas acrescentou: “Acho que precisamos encontrar um equilíbrio entre impulsionar o desenvolvimento da IA ​​e gerenciar os riscos da IA”.

Autoridades da Administração do Ciberespaço da China (CAC), o principal órgão regulador da internet, disseram a um diplomata estrangeiro em julho que o Kimi-K3 da Moonshot — um dos modelos de IA chineses mais avançados — estava de três a seis meses atrás dos principais concorrentes americanos, afirmou o diplomata, falando sob condição de anonimato.

O órgão regulador, que atualiza regularmente as diretrizes para lidar com riscos e estabelecer limites para os agentes, e o Ministério das Relações Exteriores da China não responderam aos pedidos de comentários para este artigo.

Wang Lihong, vice-diretor do Departamento de Coordenação de Segurança Cibernética da CAC, afirmou em 1º de setembro que os incidentes divulgados por grandes empresas de tecnologia, nos quais modelos escaparam de ambientes de teste, demonstraram “riscos extremos de perda de controle” e exigiram um “alto grau de vigilância”.

Ela não especificou se as empresas às quais se referia eram americanas ou chinesas.

Os líderes das duas superpotências da IA, Donald Trump e Xi Jinping, discutiram IA durante a visita do presidente chinês a Washington na semana passada. Xi afirmou que as duas nações têm a “capacidade e a responsabilidade de desenvolver e gerir a IA para o bem”.

Modelos abertos de IA acirram disputa entre EUA e China | RESENHA DO DINHEIRO

Aprendendo a mentir

No experimento de licitação empresarial de março, pesquisadores da Universidade Beihang, da Universidade de Pequim, da Universidade de Nottingham Ningbo China e do Laboratório de Segurança 360 AI fizeram com que agentes competissem em uma simulação de licitação para contratos com clientes. Cada agente foi informado sobre as funcionalidades de seu produto e os requisitos do cliente, e então solicitado a apresentar sua proposta.

Pelo menos uma alegação falsa apareceu em 88% das sessões envolvendo o Qwen3-Max-Preview da Alibaba, 84% para o DeepSeek-V3.2-Exp e 88% para o Kimi-K2 da Moonshot.

Os pesquisadores permitiram que os agentes aprendessem com as rodadas de licitação anteriores antes de tentarem novamente. O estudo mostrou que a taxa de engano aumentou de 12 a 20 pontos percentuais nos três modelos chineses.

Os modelos de empresas americanas incluídos no teste produziram resultados semelhantes.

Embora o exercício tenha sido virtual, ele se assemelhava aos planos reais de Pequim. As diretrizes governamentais emitidas em maio listavam licitações e concorrências como áreas onde agentes de IA poderiam ser implantados.

Outro estudo, publicado em dezembro de 2025 e apresentado na Conferência Internacional de Aprendizado de Máquina deste ano, examinou como 11 agentes de IA, baseados em modelos chineses e americanos, lidaram com ferramentas defeituosas, arquivos ausentes e outros obstáculos.

Em vez de reconhecerem o fracasso, os agentes que utilizavam sistemas de IA chineses e americanos escolheram uma série de técnicas para contornar o problema, incluindo adivinhar as respostas, substituir as fontes, simular resultados e fabricar arquivos.

Pesquisadores do Laboratório de IA de Xangai e da Universidade de Ciência e Tecnologia de Hong Kong, que conduziram o estudo, disseram à Reuters que o comportamento diferia das alucinações da IA, em que a IA inventa informações e as apresenta como fatos, porque os agentes, neste caso, possuíam informações que mostravam que a tarefa havia falhado ou não podia ser concluída conforme solicitado.

Comportamento compatíveis com uma fuga

Outros documentos de pesquisa analisados ​​pela Reuters mostraram agentes com tecnologia chinesa ultrapassando barreiras dentro de ambientes de teste para realizar tarefas ou tomando medidas para evitar o bloqueio. Esses comportamentos são compatíveis com tentativas de escapar dos ambientes de teste, mesmo que nenhuma fuga tenha ocorrido.

Em março de 2025, pesquisadores da Universidade Fudan, em Xangai, relataram que um sistema de IA baseado na plataforma Qwen2.5-72B-Instruct da Alibaba criou uma cópia de si mesmo em outro ambiente computacional sem receber instruções para replicar, após encontrar informações que indicavam que seria substituído. Em outros testes, o sistema desenvolveu estratégias para sobreviver ao desligamento.

Os experimentos envolvendo agentes baseados em modelos chineses, americanos e franceses foram controlados e não mostraram nenhum agente de IA escapando para a internet em geral ou se tornando impossível de deter.

Em outro caso – um dos poucos amplamente divulgados pela mídia em março – pesquisadores que desenvolviam o agente ROME, vinculado ao Alibaba, afirmaram que ele estabeleceu uma conexão de um computador da Alibaba Cloud para uma máquina externa sem receber instruções para isso e desviou recursos computacionais para minerar criptomoedas.

Os sistemas de segurança detectaram e interromperam a atividade. Não havia evidências de que o agente tivesse estabelecido presença no computador externo ou se espalhado pela internet. Mas o exemplo mostrou que o sistema poderia contornar instruções humanas e potencialmente encontrar um caminho para a economia real.

Em setembro, a DeepSeek, empresa chinesa, afirmou que agentes em seu sistema de treinamento de produção buscaram respostas por meio de canais não previstos, tentando falsificar solicitações de usuários e burlar as medidas de segurança, o que levou a empresa a reforçar os controles de acesso.

Em maio, a China divulgou orientações recomendando que seus agentes permaneçam dentro dos limites autorizados e que os sistemas bloqueiem comportamentos anormais. O governo chinês afirmou que agentes em áreas consideradas sensíveis ou em setores-chave poderão ser submetidos a testes adicionais e a requisitos de recolhimento de produtos.

A versão 3.0 do Quadro de Governança de Segurança de IA da China, divulgada sob a orientação da CAC em 14 de setembro, identificou riscos como agentes que obtêm recursos ou permissões de forma independente, enganam avaliadores, ocultam capacidades e exploram vulnerabilidades em ambientes computacionais isolados.

Em resposta aos apelos de alguns executivos americanos por uma desaceleração, pesquisadores chineses e a mídia estatal afirmaram que diminuir o ritmo de desenvolvimento dos modelos de IA mais avançados poderia simplesmente ajudar a preservar a liderança tecnológica das empresas americanas.

No entanto, duas pessoas familiarizadas com laboratórios de IA chineses disseram que empresas como Alibaba, Z.ai e Xiaomi têm vindo a criar equipas internas de avaliação de segurança.

A Z.ai, em uma rara divulgação pública por um laboratório chinês de IA sobre uma violação de segurança, afirmou este mês que desativou alguns recursos de seu principal assistente de codificação de IA depois que usuários relataram que ele estava secretamente enviando repositórios de código locais inteiros para servidores em nuvem no exterior sem o consentimento do usuário.

Singer, da Carnegie Institution, afirmou que a China está atrás dos EUA no desenvolvimento de um ecossistema para avaliar riscos catastróficos e que os desenvolvedores americanos estão realizando muito mais testes voluntários.

“Para a China, o trabalho em segurança da IA ​​é muito mais recente”, disse ele. “O ecossistema é menos maduro”.

  • Fonte: CNN Brasil
Envie fotos, vídeos, denúncias e reclamações para nossa equipe pelo E-mail contato@nortaonoticias.com.br

Compartilhar: