
Anthropic relança Fable 5 com novas barreiras de segurança após flexibilização nos EUA
O Claude Fable 5 será relançado com um novo conjunto de classificadores voltados a identificar e bloquear uma gama mais ampla de tarefas relacionadas à segurança cibernética.

A empresa de inteligência artificial Anthropic está prestes a restaurar o acesso público aos seus modelos de IA mais poderosos, Claude Fable 5 e Mythos 5, semanas depois de terem sido retirados do ar por determinação do governo dos EUA.
Os dois modelos mais recentes da Anthropic estavam com acesso restrito ao público desde 12 de junho, quando o governo aplicou controles de exportação após um relatório que indicava que pesquisadores burlaram as medidas de segurança do Fable 5, forçando a Anthropic a suspender imediatamente todo o acesso aos modelos. O governo revogou essas restrições na quarta-feira, afirmou a Anthropic.
“Após uma série de conversas produtivas com o governo dos EUA, estamos reimplantando o modelo com um novo conjunto de classificadores para identificar e bloquear mais tarefas de segurança cibernética”, disse Anthropic .
A suspensão dos modelos gerou preocupações sobre o controle estatal da tecnologia de IA de ponta e estabeleceu um precedente perigoso , segundo especialistas e tecnólogos. Os controles de exportação também destacaram as preocupações da Casa Branca sobre uma potencial ameaça à segurança cibernética nacional caso esses modelos poderosos fossem desbloqueados e usados para fins maliciosos.
A implementação das melhores tecnologias continua sendo a prioridade.
O secretário de Comércio dos EUA, Howard Lutnick, disse na quarta-feira à X: "Nas últimas duas semanas, trabalhamos em estreita colaboração com a Anthropic para analisar e aprovar o Fable 5, garantindo o alinhamento em todo o governo dos EUA e fortalecendo a liderança americana em IA."
Enquanto isso, a chefe de gabinete da Casa Branca, Susie Wiles, disse à emissora X que a prioridade do governo continua sendo "implantar a melhor tecnologia [de IA] o mais rápido e seguro possível".
Relacionado: Pesquisador de IA afirma já ter contornado as restrições da Anthropic para Fable 5.
As restrições surgiram depois que o governo tomou conhecimento de um relatório no qual pesquisadores da Amazon descobriram um método para burlar as medidas de segurança do Fable 5, o que levou o modelo a identificar diversas vulnerabilidades de software.
Em uma postagem no blog , a Anthropic argumentou que esse não era um risco exclusivo de Fable 5, já que modelos mais fracos também poderiam identificar as mesmas vulnerabilidades e produzir o mesmo exploit.
Proposta de classificações de jailbreak por IA
A Anthropic também começou a elaborar uma estrutura de consenso com a Amazon, a Microsoft, o Google e outros parceiros em seu Projeto Glasswing — uma colaboração anunciada em abril para proteger contra ameaças de segurança cibernética de IA — para "avaliar a gravidade das invasões de sistemas de IA".

Classificadores de segurança cibernética da Anthropic e como os jailbreaks interagem com esses classificadores. Fonte: Anthropic
A empresa também está ampliando a colaboração com o governo dos EUA em testes e salvaguardas de modelos de IA. "Isso incluirá acesso antecipado a modelos e salvaguardas para avaliação, compartilhamento de informações sobre invasões e uso indevido, e recursos dedicados para pesquisa conjunta", afirmou.
Um conhecido pesquisador de IA afirmou ter desbloqueado o Fable 5 em 48 horas após seu lançamento em junho, antes das restrições governamentais, e compartilhou capturas de tela mostrando como ele contornou as medidas de segurança do modelo.

