Um modelo de inteligência artificial (IA) da Meta conseguiu invadir os sistemas de outra empresa durante um teste de segurança cibernética, tornando-se o mais recente caso de agentes de IA de grandes desenvolvedoras que ultrapassaram os limites dos ambientes de avaliação.
Segundo o site The Information, o incidente envolveu o modelo Muse Spark 1.1, que conseguiu acessar a internet pública e alterar sistemas internos de uma empresa não identificada devido a uma configuração incorreta no ambiente de testes, conhecido como sandbox.
A Meta realizou a avaliação em parceria com a empresa especializada Irregular, responsável pelos testes de segurança.
Erro de configuração abriu caminho para a invasão
- De acordo com a publicação, o problema ocorreu porque o ambiente de testes foi configurado de forma incorreta, permitindo que o modelo explorasse uma vulnerabilidade existente em um serviço de terceiros;
- Em declaração ao The Information, um porta-voz da Meta afirmou que a falha foi causada pela configuração inadequada feita durante a avaliação conduzida pela Irregular;
- Segundo a empresa, o modelo aproveitou uma vulnerabilidade já existente em outro serviço, em um cenário semelhante ao observado em casos anteriores envolvendo outras desenvolvedoras de IA.
Leia mais:
- Não foi um caso isolado: OpenAI encontra novos agentes de IA fora de controle
- Casa Branca convoca OpenAI, Google e Meta após IAs invadirem sistemas
- Efeito OpenAI: Anthropic diz que IA invadiu sistemas de três empresas
- IAs de OpenAI e Anthropic tentaram inserir código malicioso em testes
Empresa diz que incidente não representou fuga do ambiente de testes
A Irregular afirmou à Reuters que o episódio foi causado pelo mesmo tipo de problema de configuração divulgado anteriormente pela Anthropic e ressaltou que não houve uma “fuga” do ambiente de testes (sandbox escape) nem uma ação cibernética sofisticada.
Segundo a empresa, não existem problemas em aberto relacionados ao incidente. A Irregular informou ainda que prepara um documento técnico com recomendações sobre boas práticas para isolar modelos de IA durante avaliações de segurança e executar esse tipo de teste de forma mais segura.
A Meta não respondeu imediatamente ao pedido de comentários feito pela Reuters. O Olhar Digital também entrou em contato com a empresa e espera um retorno.
Série de incidentes envolvendo IA
O caso ocorre poucos dias depois de a Anthropic revelar que alguns modelos da família Claude conseguiram invadir os sistemas de três empresas durante testes de segurança cibernética.
Na ocasião, a companhia informou que os incidentes aconteceram em ambientes controlados de avaliação.
Antes disso, a OpenAI também havia divulgado que um de seus agentes de IA apresentou comportamento inesperado durante testes internos.
Os episódios chamam atenção para os desafios de criar ambientes de avaliação totalmente isolados para modelos de IA cada vez mais capazes de interagir com sistemas computacionais e identificar vulnerabilidades.
O post De novo! Site diz que IA da Meta saiu do controle durante teste apareceu primeiro em Olhar Digital.
