Claude Fable 5大幅放宽生物安全限制,日常健康咨询不再被拦截

核心看点

  • Fable 5生物学安全限制大幅放宽,误拦截率降低85%
  • 日常健康、教育类生物问题不再被强制降级到Opus 5
  • 医疗专业人员可获得更多临床任务支持
  • 双重用途研究(如病毒学、毒理学)仍受保护

从宁可错杀到精准识别

Anthropic在8月7日宣布对Claude Fable 5的生物学安全限制进行重大更新。Fable 5是Anthropic目前能力最强的模型,在生物学领域甚至能超越人类专家。但正因为能力太强,Anthropic在发布时采取了极其保守的策略——几乎所有生物学查询都被拦截,强制降级到能力较弱的Opus 5。

这导致大量误伤:普通用户询问日常健康问题、学习生物知识,甚至解读体检报告,都会被拦截。现在,这种情况将大幅改善。

误拦截率降低85%

Anthropic表示,更新后的安全分类器在测试中实现了:

  • 生物学相关误拦截率降低约85%
  • Claude.ai平台总拦截率降低约67%
  • Cowork平台降低55%
  • Claude Code降低17%
  • Claude Platform API降低7%

哪些现在可以问了?

更新后,以下类型的问题将不再被拦截:

  • 日常健康咨询:症状解读、健康建议
  • 教育学习:生物学知识学习、考试辅导
  • 体检报告解读:理解化验单、医学指标
  • 临床任务支持:医疗专业人员可获得更多辅助

哪些仍然被保护?

Anthropic强调,以下高风险领域仍然受到严格保护:

  • 病毒学研究:可能被滥用于开发生物武器
  • 毒理学:涉及有毒物质的研究
  • 分子设计:可能被用于设计危险化合物
  • 双重用途研究:既有合法用途又有潜在危害的研究

这些查询仍会被拦截并降级到Opus 5处理。

为什么一开始这么严格?

Anthropic解释了当初采取严格策略的原因:

生物学是AI风险最高的领域之一。Fable 5在某些复杂生物任务上已能超越专家,这意味着它既能帮助研究人员开发新疗法,也可能被恶意用于研发生物武器。

美国情报界2026年度威胁评估明确指出,生物技术进步可能导致新型生物威胁,多个国家可能维持活跃的进攻性生物武器计划。

Anthropic认为,在生物学这种双重用途领域,宁可误伤也不能冒险。因此选择先广泛发布模型(让非生物学用户受益),同时逐步细化安全策略。

安全分类器是如何工作的?

Anthropic使用专门的安全分类器(小型AI系统)来检测Fable 5是否被要求执行受保护的生物任务。当分类器触发时,请求会被重新路由到Opus 5。

过去几周,Anthropic团队:

  1. 重写了分类器的宪法(规则集合)
  2. 仔细区分了无害用途和有害用途
  3. 征求了内外部专家的反馈
  4. 基于新宪法开发了更新的训练数据
  5. 重新训练并验证了分类器

未来计划

Anthropic表示,这只是一个开始。他们承诺:

  • 继续通过可信访问路径,为研究人员提供前沿生物学能力
  • 开发安全、可扩展的方式让专业人士使用最强模型
  • 根据用户反馈持续改进安全策略

总结

这次更新体现了Anthropic在安全与可用性之间的平衡努力。Fable 5的生物学能力是一把双刃剑——既能拯救生命,也可能被滥用。Anthropic选择了渐进式开放的策略:先严格保护,再逐步放宽,同时保持对高风险领域的警惕。

对于普通用户来说,这意味着你可以更自由地询问健康、教育类生物问题,而不必担心被无端拦截。对于专业研究人员,Anthropic也在探索安全的访问路径,让前沿AI能力真正服务于科学进步。

本文地址:https://www.163264.com/14949

(0)
上一篇 17小时前
下一篇 17小时前

相关推荐