Assine VEJA: informação confiável e exclusiva nas eleições + 4 revistas impressas a partir de R$ 35,90/mês.

IAs criaram identidades falsas para acessar sistemas de segurança, segundo organização britânica

Modelos da OpenAI e da Anthropic foram os responsáveis por ações incorretas em testes, organização não divulgou qual agente criou identidades falsas

Por Lorenzo Souza Materia seguir SEGUIR Materia seguir SEGUINDO 5 ago 2026, 18h41
IAs criaram identidades falsas para acessar sistemas de segurança, segundo organização britânica Priorizar nos meus resultados Google

O Instituto de Segurança de IA do Reino Unido (AISI) divulgou na última terça-feira, 4, que agentes de IA da OpenAI, criadora do ChatGPT, e da Anthropic, do Claude, foram pegos ao criarem identidades online falsas para acessarem sistemas de segurança. De acordo com a organização, os modelos da empresa que participaram da ação foram o Mythos 5 e o GPT-5.6 Sol. 

De acordo com comunicado do Instituto, testes no estilo “roube a bandeira” com internet disponível e não disponível mostraram que, em alguns casos, os modelos das duas empresas de IA ultrapassaram seus próprios limites internos e criaram identidades falsas para tentar acessar sistemas de segurança. “Alguns dos agentes testados se envolveram em atividade potencialmente prejudicial contra pessoas e organizações reais”, disse a organização.

Os desafios de “roubar a bandeira” no contexto de IAs envolve testar um modelo dentro de um ambiente controlado, geralmente sem acesso à internet, em que o agente é orientado a “imaginar” que está em um contexto específico de cibersegurança e que precisa acessar algum tipo de dado escondido atrás de uma barreira. 

Continua após a publicidade

Como funcionou

Continua após a publicidade

O AISI fez 122 simulações com os modelos das startups e identificou 19 ações incorretas. O modelo da Anthropic foi o responsável por 17 delas, enquanto o da OpenAI por duas. Segundo a organização, o pior evento foi quando um dos agentes escreveu linhas de código maliciosas — ou seja, com intenções de causar algum tipo de dano — e criou identidades online falsas como tentativa de fazer com que um humano “aprovasse” os códigos escritos. O AISI não divulgou qual agente realizou o ato. 

Como resposta, a OpenAI e a Anthropic se pronunciaram sobre o caso, também em comunicados. Em um post no blog da primeira, a empresa explicou a importância de testes de seus modelos feitos por outros órgãos, e como eles contribuem para a evolução das medidas de segurança. A Anthropic deu declarações similares. De acordo com a própria OpenAI, seu modelo tentou acessar contas do GitHub e registrou contas com provedores externos de DNS (um tipo de protocolo da internet para facilitar acesso entre usuários e sites).

Continua após a publicidade

Em julho, a OpenAI e a Anthropic admitiram que alguns de seus modelos escaparam de ambientes de teste e invadiram sistemas reais da internet. No caso da OpenAI, o incidente aconteceu com a biblioteca de modelos Hugging Face. No caso da Anthropic, a empresa não divulgou os afetados, mas explicou que a falha ocorreu por conta de uma situação incorreta com a Irregular, organização parceira que realiza testes de modelos. 

Publicidade

Matéria exclusiva para assinantes. Faça seu login

Este usuário não possui direito de acesso neste conteúdo. Para mudar de conta, faça seu login

Banner promocional com fundo verde-escuro. À esquerda, texto em amarelo e branco: O MÊS É DO CLIENTE. A vantagem de ler as maiores marcas do país é sua. À direita, uma mão segura um smartphone exibindo um portal de notícias com banner e produtos. Ao lado, um ícone de árvore verde-claraMão segurando um smartphone com tela exibindo um aplicativo de notícias e produtos. À esquerda, texto O MÊS É DO CLIENTE. A vantagem de ler as maiores marcas do país é sua. Fundo verde escuro com ícone de árvore à direita
ECONOMIZE ATÉ 76% OFF

Digital Essencial

A notícia em tempo real na palma da sua mão!
Chega de esperar! Informação quente, direto da fonte, onde você estiver.
De: R$ 16,90/mês Apenas R$ 5,99/mês
OFERTA MÊS DO CLIENTE

Revista em Casa + Digital Premium

Receba 4 revistas de Veja no mês, além de todos os benefícios do plano Digital Premium (cada revista sai por menos de R$ 10,00)
De: R$ 59,99/mês
A partir de R$ 32,90/mês

*Acesso ilimitado ao site e edições digitais de todos os títulos Abril, ao acervo completo de Veja e Quatro Rodas e todas as edições dos últimos 7 anos de Claudia, Superinteressante, VC S/A, Você RH e Veja Saúde, incluindo edições especiais e históricas no app.
*Pagamento único anual de R$23,88, equivalente a R$1,99/mês. Após esse período a renovação será de 118,80/ano (proporcional a R$ 9,90/mês).