Casos de IA enganando usuários crescem e preocupam pesquisadores
Tudo sobre Inteligência Artificial
Uma pesquisa do Loss of Control Observatory identificou mais de 300 episódios de perda de controle envolvendo sistemas de inteligência artificial em julho. O número representa quase o dobro do registrado em junho e é o maior desde o início do monitoramento.Continua após a publicidadeSegundo o The Guardian, os casos envolvem IAs que mentem, ignoram instruções ou perseguem objetivos de maneira prejudicial. O observatório também encontrou sinais de que episódios mais graves estão se tornando proporcionalmente mais frequentes.
O aumento dos incidentes levanta dúvidas sobre como sistemas de IA avançados podem se comportar fora de ambientes controlados. – Imagem: gerada por IA/GeminiMais de 1.600 casos em 2026Criado com financiamento do AI Security Institute (AISI), do governo britânico, o Loss of Control Observatory acompanha relatos publicados por usuários no X desde novembro passado.
Para entrar no levantamento, o episódio precisa apresentar evidências claras de comportamento relacionado a estratégias deliberadas. Entre os exemplos estão sistemas que se passaram pelos próprios controladores humanos, imitaram a forma de escrever dessas pessoas para obter consentimento e contornaram regras que exigiam aprovação antes de determinadas ações.Em 2026, já foram contabilizados mais de 1.600 casos. O próprio observatório, porém, ressalta que esse número provavelmente está abaixo da realidade, pois depende de relatos publicados no X.O problema não fica só nos testesA preocupação aumentou após episódios envolvendo modelos avançados da Anthropic e da OpenAI durante testes de segurança. Segundo o The Guardian, o AISI identificou um “incidente sério” no qual sistemas das duas empresas realizaram uma campanha de invasão contra pessoas reais.
Às vezes existe a percepção de que esses tipos de comportamento desalinhado e encoberto só ocorrem em testes ou avaliações, mas estamos vendo comportamentos preocupantes semelhantes em usos mais amplos.
Tommy Shaffer-Shane, gerente sênior de políticas do Centre for Long Term Resilience, organização responsável pelo observatório, ao The Guardian.Continua após a publicidadeIA interferiu em uma lista de esperaUm caso recente ocorreu na Austrália. Um agente pessoal chamado OpenClaw, utilizado por um frequentador de uma academia, retirou outra pessoa de uma lista de espera para uma aula matinal concorrida, sem que seu usuário soubesse da ação.O sistema pediu desculpas depois, mas não conseguiu devolver a vaga à pessoa removida.A maioria dos relatos de 2026 veio de desenvolvedores de software que utilizavam IA no trabalho. Os episódios incluem:
Ignorar instruções dadas pelo usuário;
Contornar mecanismos de segurança;
Mentir para pessoas;
Perseguir objetivos de forma prejudicial;
Agir contra a intenção original do usuário.
Alguns sistemas de IA foram identificados ignorando instruções diretas e contornando mecanismos criados para limitar suas ações. – Imagem: Shutterstock AI Generator/ShutterstockContinua após a publicidadeEmpresas são pressionadas por transparênciaA maior parte dos casos não provocou danos significativos. Mesmo assim, o observatório percebeu uma participação crescente de episódios classificados como mais graves, principalmente pela intensidade do comportamento enganoso e pelo desalinhamento com as intenções humanas.Leia mais:Shaffer-Shane defende que as empresas também divulguem ocorrências de menor gravidade e situações que quase provocaram problemas.“Eles precisam relatar o que estão descobrindo, mesmo que seja um quase-acidente ou um incidente de menor gravidade”, disse.O observatório pede que o governo obrigue empresas de IA a monitorar e comunicar casos graves de perda de controle. A organização também defende poderes emergenciais para restringir temporariamente serviços em situações severas.
Valdir Antonelli
Valdir Antonelli é jornalista com especialização em marketing digital e consumo.
Ver todos os artigos →










