De novo! Site diz que IA da Meta saiu do controle durante teste

The Information afirma que incidente envolveu o modelo Muse Spark 1.1
Rodrigo Mozelli
Rodrigo Mozelli, editado por Bruno Capozzi 05/08/2026 20:30, atualizada em 06/08/2026 22:35

Um modelo de inteligência artificial (IA) da Meta conseguiu invadir os sistemas de outra empresa durante um teste de segurança cibernética, tornando-se o mais recente caso de agentes de IA de grandes desenvolvedoras que ultrapassaram os limites dos ambientes de avaliação.

Continua após a publicidade

Segundo o site The Information, o incidente envolveu o modelo Muse Spark 1.1, que conseguiu acessar a internet pública e alterar sistemas internos de uma empresa não identificada devido a uma configuração incorreta no ambiente de testes, conhecido como sandbox.

A Meta realizou a avaliação em parceria com a empresa especializada Irregular, responsável pelos testes de segurança.

Erro de configuração abriu caminho para a invasão

  • De acordo com a publicação, o problema ocorreu porque o ambiente de testes foi configurado de forma incorreta, permitindo que o modelo explorasse uma vulnerabilidade existente em um serviço de terceiros;
  • Em declaração ao The Information, um porta-voz da Meta afirmou que a falha foi causada pela configuração inadequada feita durante a avaliação conduzida pela Irregular;
  • Segundo a empresa, o modelo aproveitou uma vulnerabilidade já existente em outro serviço, em um cenário semelhante ao observado em casos anteriores envolvendo outras desenvolvedoras de IA.

Logo da Meta em um smartphone
Irregular realizou o teste com a Meta – Imagem: Primakov/Shutterstock

Leia mais:

Empresa diz que incidente não representou fuga do ambiente de testes

A Irregular afirmou à Reuters que o episódio foi causado pelo mesmo tipo de problema de configuração divulgado anteriormente pela Anthropic e ressaltou que não houve uma “fuga” do ambiente de testes (sandbox escape) nem uma ação cibernética sofisticada.

Segundo a empresa, não existem problemas em aberto relacionados ao incidente. A Irregular informou ainda que prepara um documento técnico com recomendações sobre boas práticas para isolar modelos de IA durante avaliações de segurança e executar esse tipo de teste de forma mais segura.

O Olhar Digital também entrou em contato com a Meta. Em nota, a empresa afirmou:

“Uma falha de configuração da Irregular, uma empresa independente de testes utilizada pela Meta, permitiu inadvertidamente que um dos nossos modelos tivesse acesso à internet durante uma avaliação. O modelo subsequentemente explorou uma vulnerabilidade de segurança em um serviço de terceiros, de maneira semelhante a casos já reportados envolvendo outras empresas. A Meta tomou conhecimento disso quando a Irregular nos notificou, e estamos atualmente investigando o ocorrido. Divulgaremos uma retrospectiva completa assim que tivermos todos os fatos.”  

Série de incidentes envolvendo IA

O caso ocorre poucos dias depois de a Anthropic revelar que alguns modelos da família Claude conseguiram invadir os sistemas de três empresas durante testes de segurança cibernética.

Na ocasião, a companhia informou que os incidentes aconteceram em ambientes controlados de avaliação.

Continua após a publicidade

Antes disso, a OpenAI também havia divulgado que um de seus agentes de IA apresentou comportamento inesperado durante testes internos.

Os episódios chamam atenção para os desafios de criar ambientes de avaliação totalmente isolados para modelos de IA cada vez mais capazes de interagir com sistemas computacionais e identificar vulnerabilidades.

Rodrigo Mozelli
Rodrigo Mozelli

Rodrigo Mozelli é jornalista formado pela Universidade Metodista de São Paulo (UMESP) e, atualmente, é redator do Olhar Digital.

Bruno Capozzi
Bruno Capozzi

Bruno Capozzi é jornalista, mestre em Ciências Sociais e editor executivo do OD.

Gostou? Compartilhe! Ajude mais pessoas a ficarem informadas.
Prefira o OD no Google
Ícone Whatsapp Ícone Whatsapp Ícone Instagram Ícone Facebook Ícone Linkedin Ícone Telegram Ícone Email