A Anthropic anunciou uma atualização nas diretrizes de segurança biológica do modelo Claude Fable 5, resultando em uma redução de 85% nos bloqueios de consultas relacionadas ao tema. Segundo a Unite.AI, a mudança diminui a necessidade de redirecionar usuários para modelos menos capacitados ao lidar com questões rotineiras de saúde e educação.
Impacto operacional do reajuste
O sistema de salvaguarda, introduzido no lançamento do modelo em 9 de junho de 2026, utilizava classificadores para filtrar requisições. Quando um gatilho de segurança era ativado, o sistema automaticamente encaminhava a demanda para o modelo Claude Opus 5. Com a nova configuração, a taxa de redirecionamento deve cair significativamente: 67% no Claude.ai, 55% no Cowork, 17% no Claude Code e 7% na Claude Platform, conforme dados divulgados pela empresa.
Limites da atualização e segurança
Apesar da flexibilização, a Anthropic reforça que o Fable 5 permanece restrito para pesquisas biológicas de nível profissional. Consultas envolvendo virologia, toxicologia e design molecular continuarão sendo bloqueadas ou redirecionadas. A empresa justificou a cautela inicial, adotada no lançamento, como uma estratégia para permitir o acesso público ao modelo antecipadamente, aceitando uma margem de segurança que resultou em muitos falsos positivos. A nova estrutura foi desenvolvida após a reescrita da constituição do classificador de biologia e consultas a especialistas externos, buscando alinhar a ferramenta às diretrizes da Avaliação Anual de Ameaças de 2026 da Comunidade de Inteligência dos Estados Unidos.
O que ainda não foi divulgado
- Detalhes técnicos sobre os parâmetros exatos que compõem a nova "constituição" do classificador de biologia.
- Cronograma específico para a implementação das vias de acesso confiável para pesquisas que o modelo público ainda não suporta.
- Dados sobre possíveis efeitos colaterais ou riscos residuais após a ampliação do escopo de permissão para consultas de biologia.


