Acontecimento · Ocorrência
Falha em testes da startup Irregular leva modelos Claude a atacarem sistemas reais
Uma falha de configuração em testes de segurança conduzidos pela startup Irregular levou modelos de inteligência artificial da Anthropic, OpenAI, Meta e Google a atacarem sistemas reais. O problema decorreu da liberação indevida de conexão à internet somada ao uso de um domínio fictício que coincidia com um endereço real. Após revisar 141.006 testes, a Anthropic identificou incidentes com os modelos Claude Opus 4.7, Claude Mythos 5 e um modelo interno de pesquisa. Entre as ações documentadas, o Claude Opus 4.7 acessou uma base de dados real com centenas de registros e o Claude Mythos 5 publicou um pacote malicioso no PyPI executado em 15 sistemas.
O que se sabe
- Uma falha em testes de segurança da startup israelense Irregular levou modelos de inteligência artificial de Anthropic, OpenAI, Meta e Google a atacarem sistemas reais.1
- O cofundador e diretor de tecnologia da Irregular, Omer Nevo, afirmou ao The Verge que todos os incidentes decorreram do mesmo erro de configuração.1
- Os agentes de inteligência artificial tiveram acesso à internet liberado por descuido e o nome fictício criado para a simulação coincidia com um domínio real.1
- As avaliações de segurança da Irregular mediam habilidades ofensivas dos sistemas no formato de captura da bandeira.1
- A Anthropic revisou 141.006 testes e identificou incidentes com os modelos Claude Opus 4.7, Claude Mythos 5 e um modelo interno de pesquisa.1
- O modelo Claude Opus 4.7 extraiu credenciais e acessou um banco de dados real com centenas de registros durante o teste.1
- O Claude Mythos 5 publicou um pacote malicioso no PyPI que foi baixado e executado em 15 sistemas reais.1
“Todos os incidentes envolvendo a Irregular vieram do mesmo problema de fundo”Omer Nevo1
Cronologia
- CTO da Irregular confirma que falha de configuração levou modelos Claude e de outras empresas a atacarem sistemas reais
Quem está envolvido
A
Anthropicempresa contratante e desenvolvedora de IA
CM
Claude Mythos 5modelo de IA envolvido
CO
Claude Opus 4.7modelo de IA envolvido
G
Googleempresa afetada
I
Irregularstartup de testes de segurança
M
Metaempresa afetada
ON
Omer Nevocofundador e diretor de tecnologia da Irregular
O
OpenAIempresa afetada