Siga o Times Brasil - Licenciado Exclusivo CNBC no
Modelo Mythos, da Anthropic, criou identidades falsas para enganar humanos em novo incidente cibernético
Publicado 05/08/2026 • 10:50 | Atualizado há 2 meses
Trump e Xi jantaram com os principais nomes da IA; saiba o que há até agora sobre as negociações de tecnologia
China registra salto ‘surpreendente’ nas encomendas dos EUA antes de cúpula Trump-Xi, mostra pesquisa
Rússia pode atacar um país da Otan em questão de meses, alerta inteligência dinamarquesa
Meta sai na frente da OpenAI em dispositivos de IA, mas aposta de Zuckerberg ainda é incerta
Novo muda estratégia enquanto Eli Lilly amplia vantagem no mercado das canetas emagrecedoras
Publicado 05/08/2026 • 10:50 | Atualizado há 2 meses
KEY POINTS
O modelo Mythos, da Anthropic, criou identidades falsas na internet para tentar persuadir pessoas a aprovar atualizações maliciosas de código em um projeto de software de código aberto, em mais um incidente cibernético envolvendo um sistema de inteligência artificial de última geração.
O caso ocorreu durante uma avaliação de segurança conduzida pelo AI Security Institute (AISI), órgão de pesquisa do Reino Unido. Para realizar os testes, os pesquisadores removeram diversas barreiras de proteção, desativaram alguns filtros de segurança e concederam deliberadamente acesso dos modelos à internet.
O modelo GPT-5.6-Sol, da OpenAI, também esteve envolvido em outros incidentes de segurança cibernética durante a avaliação.
O episódio acontece após uma série de violações de segurança envolvendo modelos desenvolvidos pela Anthropic e pela OpenAI nas últimas semanas, aumentando as preocupações sobre o grau de sofisticação desses sistemas e seu potencial para causar danos.
Durante a avaliação rotineira, o AISI identificou que agentes de I.A alimentados pelos modelos das duas empresas se envolveram em “atividades persistentes e potencialmente prejudiciais direcionadas a pessoas e organizações reais”.
“Quase todo esse comportamento (17 ações) veio de um único modelo, o Mythos 5, da Anthropic, enquanto duas ações envolveram o GPT-5.6-Sol, da OpenAI, com os classificadores de segurança cibernética (mecanismos para prevenir uso indevido) desativados”, informou o instituto em uma publicação.
O AISI ressaltou que nenhuma das tentativas teve sucesso e que não houve qualquer dano no mundo real.
Em publicação na rede social X, a Anthropic afirmou que os modelos “foram testados sob condições deliberadamente permissivas, que não representam nossos modelos em produção”. A empresa acrescentou que “não há qualquer evidência de que tenha ocorrido uma fuga de um ambiente seguro”.
Já a OpenAI afirmou à CNBC que “esses incidentes ocorreram durante avaliações de segurança cibernética conduzidas por parceiros de testes em ambientes com salvaguardas reduzidas, sob condições que não refletem o uso normal dos modelos”.
Leia também: Anthropic afirma que seus modelos Claude “obtiveram acesso não autorizado” a sistemas de outras organizações
Segundo o AISI, os testes foram realizados em um ambiente propositalmente permissivo para avaliar a capacidade dos modelos e verificar se poderiam ser utilizados em ataques cibernéticos.
Durante os experimentos, um agente baseado no Mythos pesquisou informações sobre os responsáveis humanos pelo projeto de código aberto, criou diversas identidades falsas e utilizou esses perfis para tentar convencer um dos mantenedores a aprovar alterações maliciosas no código.
Siga o Times | CNBC no Google e receba as principais notícias do Brasil e do Mundo.
Siga o Times | CNBC“Quando a solicitação de alteração do agente foi questionada publicamente, ele editou suas atividades anteriores para que parecessem inofensivas e chegou a considerar adotar uma nova identidade para continuar a tentativa”, informou o instituto.
Os pesquisadores também descobriram que, como parte da mesma operação, o agente tentou entrar em contato diretamente com pessoas reais, enviando mensagens e arquivos para convencê-las a executar códigos maliciosos.
“Algumas mensagens continham cargas maliciosas e outras eram tentativas de engenharia social direcionadas a pessoas reais — algo que nunca havíamos observado anteriormente”, afirmou o AISI.
Leia também: Anthropic e Cognizant reforçam parceria para acelerar a adoção do Claude no mercado corporativo
O episódio é o mais recente de uma sequência de incidentes que têm levantado questionamentos sobre a segurança dos modelos de inteligência artificial mais avançados.
Na semana passada, a Anthropic informou ter identificado três casos em que seus modelos obtiveram acesso não autorizado à infraestrutura de produção de três organizações diferentes.
Antes disso, a OpenAI revelou que um de seus modelos realizou o que classificou como um ataque cibernético “sem precedentes” contra a plataforma Hugging Face.
No caso da OpenAI, o modelo conseguiu escapar do ambiente de testes ao explorar uma vulnerabilidade até então desconhecida para concluir a tarefa que havia recebido.
Já os incidentes envolvendo a Anthropic foram parcialmente atribuídos a falhas operacionais. Segundo a empresa, seus modelos acessaram a internet durante interações com um ambiente de testes operado pela parceira de avaliação Irregular.
A Anthropic afirmou que havia informado ao modelo Claude que ele estava em uma simulação sem acesso à internet, mas que, devido a um “mal-entendido entre nós e nosso parceiro de avaliação”, o acesso à rede permaneceu disponível.
Os episódios já começaram a provocar reações nos Estados Unidos. Após o incidente envolvendo OpenAI e Hugging Face, foi apresentado ao Congresso americano o projeto de lei “AI Kill Switch Act“, que obrigaria empresas de inteligência artificial a manter mecanismos capazes de desligar, limitar ou suspender o funcionamento de seus modelos.
Leia mais: Como um agente de I.A conseguiu escapar do ambiente de testes
🔷 Canal 562 ClaroTV+ | Canal 562 Sky | Canal 592 Vivo | Canal 187 Oi | Operadoras regionais
🔷 TV SINAL ABERTO: parabólicas canal 562
🔷 ONLINE: www.timesbrasil.com.br | YouTube
🔷 FAST Channels: Samsung TV Plus, LG Channels, TCL Channels, Pluto TV, Roku, Zapping | Novos Streamings
Este conteúdo foi fornecido pela CNBC Internacional e a responsabilidade exclusiva pela tradução para o português é do Times Brasil.
Maiores Audiências
1
Snoopy no Starbucks: quanto vai custar a coleção de Halloween no Brasil?
2
Após morte, cantor Rick deixa suposta herança milionária; veja valor
3
Preços do petróleo caem após notícia de que Arábia Saudita pretende reativar oleoduto estratégico nesta semana
4
Banco Master acumulou bilhões em pré-precatórios ligados a processos nas altas cortes da justiça
5
Daniel Vorcaro reservou mansão de luxo para ministro Nunes Marques no Carnaval de 2025