OCTO+

Anthropic reduz falsos positivos no Claude Fable 5

Anthropic atualiza o modelo Claude Fable 5, diminuindo em 85% os bloqueios indevidos em consultas de biologia.

09 de ago., 17:14 1 fonte · 1 país Modelos
ModelosAnthropic
Visualização abstrata de uma rede de dados digitais Foto: Pachon in Motion / Pexels

A Anthropic anunciou uma atualização nas configurações de segurança do modelo Claude Fable 5, reduzindo a incidência de bloqueios indevidos em consultas relacionadas à área de biologia. Segundo a ITmedia, a empresa conseguiu diminuir em cerca de 85% os chamados falsos positivos, fenômeno que forçava o sistema a alternar para modelos inferiores durante interações consideradas inofensivas.

Ajustes no sistema de proteção

O Claude Fable 5 utiliza um componente secundário, denominado classificador, projetado para monitorar pedidos sobre cibersegurança e temas biológicos ou químicos. Desde o lançamento, ocorrido em 9 de junho, a ferramenta operava com filtros conservadores. A diretriz original visava evitar que o modelo fornecesse informações que pudessem elevar a capacidade de atores mal-intencionados em tarefas biológicas complexas, seguindo alertas sobre riscos em genoma e biologia sintética.

A empresa informou que a reconfiguração envolveu a reescrita das regras de proteção e um novo treinamento do classificador com base em dados mais precisos. O objetivo foi separar claramente o uso educacional e de saúde do uso indevido. Consultas simples, como interpretação de exames e explicações sobre o funcionamento do DNA, agora devem ser processadas com maior precisão sem interrupção de serviço.

Equipamento de laboratório e microscópio sobre uma bancada
Foto: Tima Miroshnichenko / Pexels

Limitações persistentes

Apesar da flexibilização, a Anthropic mantém restrições rigorosas para tópicos considerados de uso duplo, como virologia e design molecular. Essas consultas continuarão sendo direcionadas ao modelo Claude Opus 5. A companhia ressalta que o Fable 5 ainda não está apto para atuar em pesquisas biológicas profissionais de ponta ou processos complexos de criação de medicamentos.

A empresa planeja reduzir gradualmente as lacunas de segurança através de um programa de acesso confiável. Usuários que ainda encontrarem dificuldades com o bloqueio de solicitações de baixo risco devem continuar enviando retornos para a equipe de desenvolvimento.

O que ainda não foi divulgado

Apurado em 1 fonte

ITmedia AI+ (Japão)

Continue lendo

Receba sem abrir o site

no e-mail ou no WhatsApp · análises + plantão + resumo semanal · cancele com 1 clique
Pronto. A primeira edição chega no seu e-mail.

Assine GRÁTIS e cancele com 1 CLIQUE quando quiser. ;)