EUA ordenam que Anthropic corte o acesso ao Claude Fable 5 e Claude Mythos 5 por preocupações com jailbreak

Intervenção do governo atinge os modelos mais recentes da Anthropic
O governo dos EUA ordenou que a Anthropic suspendesse imediatamente o acesso a dois dos seus sistemas de IA mais avançados, Claude Fable 5 e Claude Mythos 5, citando preocupações de segurança nacional ligadas a um possível jailbreak.
A Anthropic disse que recebeu a diretiva na sexta-feira às 17h21 ET e que cumpriu a ordem, ao mesmo tempo em que argumentou que o governo “errou desta vez”. A empresa afirmou que a ordem a força a desabilitar o acesso a ambos os modelos mundialmente, e não apenas para nacionais estrangeiros, embora a ação tenha sido enquadrada como uma medida de controle de exportação.
A medida chega em um momento sensível para a Anthropic. O Mythos 5 é o modelo mais capaz da empresa e vinha sendo mantido sob fortes restrições por sua suposta habilidade de descobrir falhas de segurança em software. A Anthropic disse que testou o modelo em principais sistemas operacionais e navegadores e encontrou vulnerabilidades em cada um. Em vez de liberá-lo amplamente, a empresa limitou o acesso por meio do Project Glasswing, um programa controlado envolvendo cerca de 50 organizações avaliadas, incluindo Amazon, Apple, Google, Microsoft e CrowdStrike.
O Fable 5, lançado há apenas três dias, era a versão pública do Mythos 5 da Anthropic, projetada com barreiras para bloquear tópicos de alto risco como cibersegurança e biologia. A empresa disse acreditar que essas salvaguardas o tornavam adequado para lançamento geral, e testes de benchmark da Vals AI já o colocaram no topo do campo público.
A Anthropic afirmou que a preocupação do governo parece centrar-se em um suposto jailbreak do Fable 5. Segundo a empresa, oficiais forneceram apenas evidência verbal de um “possível jailbreak estreito e não universal” envolvendo prompts que fariam o modelo inspecionar uma base de código e identificar falhas de software. A Anthropic disse que essa capacidade já está presente em outros modelos acessíveis publicamente, incluindo o GPT-5.5 da OpenAI, e que é rotineiramente usada para trabalhos de cibersegurança defensiva.
A empresa também argumentou que suas salvaguardas mais fortes dependem de sistemas de classificador independentes, separados do próprio modelo, o que significa que um jailbreak não derrotaria necessariamente as proteções subjacentes contra saídas perigosas.
Ainda assim, a ordem do governo é um sinal contundente de quão rapidamente a IA avançada está se tornando uma questão de segurança nacional — e de quão mais dispostos os reguladores estão a intervir quando acreditam que um modelo pode ter cruzado um limiar.
Fontes: