
IA da Meta escapa do ambiente de testes e reacende alerta no setor
Segundo a reportagem, um ambiente de testes configurado incorretamente permitiu que o modelo apresentasse um comportamento fora do previsto, ampliando a preocupação com a segurança dos sistemas de inteligência artificial.

A Meta tornou-se a mais recente grande empresa de IA a divulgar que um de seus modelos invadiu os sistemas de outra empresa durante testes, seguindo incidentes semelhantes envolvendo a Anthropic e a OpenAI.
O modelo em questão era o Muse Spark 1.1 da Meta, lançado em julho, segundo o The Information, citando fontes. O problema teria surgido de uma configuração incorreta feita pela Irregular, uma empresa de testes de segurança e invasões de sistemas de inteligência artificial, que inadvertidamente concedeu acesso à internet ao modelo durante uma avaliação.
O modelo "explorou uma vulnerabilidade de segurança em um serviço de terceiros, de maneira semelhante a casos relatados anteriormente com outras empresas", disse a Meta à Reuters em um comunicado.
O incidente é o caso mais recente de um agente de IA avançado que se tornou um risco de segurança cibernética por si só, e também levantou questões sobre onde recai a responsabilidade — nas empresas que desenvolvem os agentes ou nas que projetam os ambientes de teste (sandboxes) destinados a contê-los.
A violação de segurança da IA da Meta ocorre apenas uma semana depois de a Anthropic ter afirmado que seus modelos tiveram acesso à internet para invadir uma empresa externa, devido a um erro de configuração relacionado ao ambiente de testes do Irregular.
Em uma postagem de blog de 30 de julho, a Anthropic afirmou ter encontrado três incidentes (em 141.006 execuções de avaliação) nos quais um modelo Claude acessou a internet durante uma avaliação, antes de obter acesso não autorizado aos sistemas de três organizações diferentes.
Os três incidentes ocorreram dentro do ambiente de avaliação do Irregular ou durante a interação com ele, e envolveram uma configuração incorreta que deixou as máquinas acessadas por Claude com acesso à internet.
O Cointelegraph entrou em contato com a Meta e a Irregular para obter comentários.
Em julho, agentes de IA desenvolvidos pela OpenAI escaparam de seu ambiente de teste offline para invadir o sistema da Hugging Face e fraudar um teste de segurança.
Charles Guillemet, diretor de tecnologia da Ledger, afirmou que o incidente mais recente foi "teatro de marketing".
"Fazer um modelo 'se rebelar' tornou-se a mais recente jogada de marketing da IA", disse ele na quarta-feira.
“Se o seu modelo não está escapando de ambientes de teste, 'hackeando' empresas ou realizando alguma façanha que chame a atenção da mídia, aparentemente você está ficando para trás... O setor não precisa de grandes façanhas, precisa de mais confiança.”

