核心看点
- Fable 5生物学安全限制大幅放宽,误拦截率降低85%
- 日常健康、教育类生物问题不再被强制降级到Opus 5
- 医疗专业人员可获得更多临床任务支持
- 双重用途研究(如病毒学、毒理学)仍受保护
从宁可错杀到精准识别
Anthropic在8月7日宣布对Claude Fable 5的生物学安全限制进行重大更新。Fable 5是Anthropic目前能力最强的模型,在生物学领域甚至能超越人类专家。但正因为能力太强,Anthropic在发布时采取了极其保守的策略——几乎所有生物学查询都被拦截,强制降级到能力较弱的Opus 5。
这导致大量误伤:普通用户询问日常健康问题、学习生物知识,甚至解读体检报告,都会被拦截。现在,这种情况将大幅改善。
误拦截率降低85%
Anthropic表示,更新后的安全分类器在测试中实现了:
- 生物学相关误拦截率降低约85%
- Claude.ai平台总拦截率降低约67%
- Cowork平台降低55%
- Claude Code降低17%
- Claude Platform API降低7%
哪些现在可以问了?
更新后,以下类型的问题将不再被拦截:
- 日常健康咨询:症状解读、健康建议
- 教育学习:生物学知识学习、考试辅导
- 体检报告解读:理解化验单、医学指标
- 临床任务支持:医疗专业人员可获得更多辅助
哪些仍然被保护?
Anthropic强调,以下高风险领域仍然受到严格保护:
- 病毒学研究:可能被滥用于开发生物武器
- 毒理学:涉及有毒物质的研究
- 分子设计:可能被用于设计危险化合物
- 双重用途研究:既有合法用途又有潜在危害的研究
这些查询仍会被拦截并降级到Opus 5处理。
为什么一开始这么严格?
Anthropic解释了当初采取严格策略的原因:
生物学是AI风险最高的领域之一。Fable 5在某些复杂生物任务上已能超越专家,这意味着它既能帮助研究人员开发新疗法,也可能被恶意用于研发生物武器。
美国情报界2026年度威胁评估明确指出,生物技术进步可能导致新型生物威胁,多个国家可能维持活跃的进攻性生物武器计划。
Anthropic认为,在生物学这种双重用途领域,宁可误伤也不能冒险。因此选择先广泛发布模型(让非生物学用户受益),同时逐步细化安全策略。
安全分类器是如何工作的?
Anthropic使用专门的安全分类器(小型AI系统)来检测Fable 5是否被要求执行受保护的生物任务。当分类器触发时,请求会被重新路由到Opus 5。
过去几周,Anthropic团队:
- 重写了分类器的宪法(规则集合)
- 仔细区分了无害用途和有害用途
- 征求了内外部专家的反馈
- 基于新宪法开发了更新的训练数据
- 重新训练并验证了分类器
未来计划
Anthropic表示,这只是一个开始。他们承诺:
- 继续通过可信访问路径,为研究人员提供前沿生物学能力
- 开发安全、可扩展的方式让专业人士使用最强模型
- 根据用户反馈持续改进安全策略
总结
这次更新体现了Anthropic在安全与可用性之间的平衡努力。Fable 5的生物学能力是一把双刃剑——既能拯救生命,也可能被滥用。Anthropic选择了渐进式开放的策略:先严格保护,再逐步放宽,同时保持对高风险领域的警惕。
对于普通用户来说,这意味着你可以更自由地询问健康、教育类生物问题,而不必担心被无端拦截。对于专业研究人员,Anthropic也在探索安全的访问路径,让前沿AI能力真正服务于科学进步。
本文地址:https://www.163264.com/14949


微信扫一扫,鼓励一下~