Anthropic reduz em 85% os bloqueios indevidos do Fable 5 em biologia
A atualização expõe o problema central da segurança biológica: proteger contra utilização maliciosa sem bloquear investigadores, profissionais de saúde e utilizadores com perguntas legítimas.
O que mudou
A Anthropic atualizou os mecanismos de segurança do Claude Fable 5 para reduzir falsos positivos em perguntas de biologia. Nos testes internos da empresa, as situações em que o sistema transferia a pergunta para um modelo menos capaz diminuíram cerca de 85%. A mudança deverá permitir mais apoio em interpretação de resultados laboratoriais, compreensão de sintomas, educação e tarefas clínicas.
Onde continuam os limites
Pedidos considerados de dupla utilização, incluindo virologia, toxicologia e desenho molecular, continuam a ser encaminhados para o Opus 5. A Anthropic diz que o Fable 5 supera especialistas em algumas tarefas complexas e pode aumentar capacidades de atores maliciosos, razão pela qual ainda não abre integralmente o modelo à investigação profissional em biologia e desenvolvimento de medicamentos.
O que acompanhar
Avaliações externas da redução de falsos positivos, criação de vias de acesso verificadas para cientistas, falsos negativos que possam deixar passar pedidos perigosos e a forma como hospitais e empresas farmacêuticas auditam respostas geradas pelo modelo.
Fonte original
Ler na Anthropic ↗