Anthropic reduz em 85% os bloqueios indevidos do Fable 5 em biologia

A atualização expõe o problema central da segurança biológica: proteger contra utilização maliciosa sem bloquear investigadores, profissionais de saúde e utilizadores com perguntas legítimas.

O que mudou

A Anthropic atualizou os mecanismos de segurança do Claude Fable 5 para reduzir falsos positivos em perguntas de biologia. Nos testes internos da empresa, as situações em que o sistema transferia a pergunta para um modelo menos capaz diminuíram cerca de 85%. A mudança deverá permitir mais apoio em interpretação de resultados laboratoriais, compreensão de sintomas, educação e tarefas clínicas.

Onde continuam os limites

Pedidos considerados de dupla utilização, incluindo virologia, toxicologia e desenho molecular, continuam a ser encaminhados para o Opus 5. A Anthropic diz que o Fable 5 supera especialistas em algumas tarefas complexas e pode aumentar capacidades de atores maliciosos, razão pela qual ainda não abre integralmente o modelo à investigação profissional em biologia e desenvolvimento de medicamentos.

O que acompanhar

Avaliações externas da redução de falsos positivos, criação de vias de acesso verificadas para cientistas, falsos negativos que possam deixar passar pedidos perigosos e a forma como hospitais e empresas farmacêuticas auditam respostas geradas pelo modelo.

Fonte original

Ler na Anthropic

PARTILHAR

Vale a pena passar adiante?