Anthropic 更新了 Claude Fable 5 的生物安全分类器。
按其内部测试,生物相关请求触发“回退”的次数减少约 85%,日常健康、临床辅助和生物教学更有机会由 Fable 5 直接完成。
这里的“回退”不是拒答,而是系统认为请求可能有风险后,改由能力较弱的 Opus 5 作答。此前护栏划得太宽,解读化验结果、理解症状这类正常任务也容易被切走。
Anthropic 这次重写了分类规则,补充良性用途边界,再用新数据训练分类器。
对使用者来说,最实际的变化不是多了一个功能,而是同一段健康或生物工作流更少突然换模型,回答质量也更容易保持一致。
边界仍然很清楚:病毒学、毒理学、分子设计等可能兼具科研与滥用价值的专业请求,仍会回退到 Opus 5。
它可以更顺手地处理科普、检查结果解释和部分临床任务,但还不能当作开放的药物研发工具,更不等于医疗结论可靠性已经得到保证。
这类安全更新该看的不是“拦得多不多”,而是正常工作少被打断的同时,高风险能力有没有继续被隔离。
85% 是 Anthropic 自测的回退降幅,不是独立测得的误报率,也不能直接当成医学准确率。
顯示更多