Tudo sobre Inteligência Artificial
Um modelo de inteligência artificial (IA) da Meta conseguiu invadir os sistemas de outra empresa durante um teste de segurança cibernética, tornando-se o mais recente caso de agentes de IA de grandes desenvolvedoras que ultrapassaram os limites dos ambientes de avaliação.
Continua após a publicidade
Segundo o site The Information, o incidente envolveu o modelo Muse Spark 1.1, que conseguiu acessar a internet pública e alterar sistemas internos de uma empresa não identificada devido a uma configuração incorreta no ambiente de testes, conhecido como sandbox.
A Meta realizou a avaliação em parceria com a empresa especializada Irregular, responsável pelos testes de segurança.
Erro de configuração abriu caminho para a invasão
- De acordo com a publicação, o problema ocorreu porque o ambiente de testes foi configurado de forma incorreta, permitindo que o modelo explorasse uma vulnerabilidade existente em um serviço de terceiros;
- Em declaração ao The Information, um porta-voz da Meta afirmou que a falha foi causada pela configuração inadequada feita durante a avaliação conduzida pela Irregular;
- Segundo a empresa, o modelo aproveitou uma vulnerabilidade já existente em outro serviço, em um cenário semelhante ao observado em casos anteriores envolvendo outras desenvolvedoras de IA.

Leia mais:
Empresa diz que incidente não representou fuga do ambiente de testes
A Irregular afirmou à Reuters que o episódio foi causado pelo mesmo tipo de problema de configuração divulgado anteriormente pela Anthropic e ressaltou que não houve uma “fuga” do ambiente de testes (sandbox escape) nem uma ação cibernética sofisticada.
Segundo a empresa, não existem problemas em aberto relacionados ao incidente. A Irregular informou ainda que prepara um documento técnico com recomendações sobre boas práticas para isolar modelos de IA durante avaliações de segurança e executar esse tipo de teste de forma mais segura.
A Meta não respondeu imediatamente ao pedido de comentários feito pela Reuters. O Olhar Digital também entrou em contato com a empresa e espera um retorno.
Série de incidentes envolvendo IA
O caso ocorre poucos dias depois de a Anthropic revelar que alguns modelos da família Claude conseguiram invadir os sistemas de três empresas durante testes de segurança cibernética.
Na ocasião, a companhia informou que os incidentes aconteceram em ambientes controlados de avaliação.
Antes disso, a OpenAI também havia divulgado que um de seus agentes de IA apresentou comportamento inesperado durante testes internos.
Os episódios chamam atenção para os desafios de criar ambientes de avaliação totalmente isolados para modelos de IA cada vez mais capazes de interagir com sistemas computacionais e identificar vulnerabilidades.
Rodrigo Mozelli
Rodrigo Mozelli é jornalista formado pela Universidade Metodista de São Paulo (UMESP) e, atualmente, é redator do Olhar Digital.
Ver todos os artigos →


