
八月七日,Anthropic 宣布收紧的不是 Fable 5 的生物学能力,而是误伤。Improving Fable 5's biology safeguards 说,分类器更新后,生物学相关 fallback(系统把请求切到更弱模型)大约少了 85%;所有原因合计的 fallback,在 Claude.ai 约降 67%、Cowork 约 55%、Claude Code 约 17%、Platform 约 7%。
用户体感会落在日常:读化验单、问症状、学生物,更少被“降智”。但同一篇也写明:病毒学、毒理、分子设计等双用途请求,仍会落到 Opus 5;职业生物学研究与药物开发仍要等可信访问通道。
[1]官方改了什么,没改什么
官方目标写得很直:尽快把 Fable 5 能力交到尽可能多的用户手里,同时管理生物风险。评估显示 Fable 5 已能在部分高难度生物任务上超过专家、并提供操作层支持——对研发药品是机会,对恶意行为者则是“别处找不到的 uplift”。
难处在善意与恶意常常同构:活疫苗要培养病原体,降压药卡托普利的故事从蛇毒降压成分讲起。会利用模糊性的对手,会把危险任务打扮成普通研究。因此 Anthropic 长期用强分类器,代价是假阳性:良性生物问题也被踢去弱模型。
这次更新攻击的正是假阳性。双用途门仍在;可信访问仍是未完成的产品承诺。
[1]Fallback 数字该怎么读
作者判断:85% 是“生物相关 fallback”的相对降幅,不等于生物能力全面放开;总 fallback 在各表面降幅不一,说明 Code/API 场景里生物误伤本就不是主因,聊天与 Cowork 才是受益大户。
把双用途继续钉在 Opus 5,等于承认:开放与安全的折中暂时落在“日常保健放开、前沿湿实验仍关门”。对医院教育场景友好,对 biotech 研究团队仍不够。
[1]产品与竞争意味
对 Claude.ai / Cowork 用户,这是体验补丁;对 Platform 开发者,7% 的总 fallback 降幅暗示 API 侧本来就更少误伤,或流量结构不同。对想用 Fable 做蛋白/药物设计的团队,关键句仍是 trusted access——没有名单与审计流程,能力叙事到不了实验台。
竞争上,各家都在生物能力与生物安全之间拉锯。Anthropic 选择公开假阳性改进,而不是只喊 RSP 口号,有助于企业采购时核对“会不会动不动降级”。
[1]评论员看法
这篇最重要的诚实,是同时写下“误报少了”和“双用途仍关着”。少了前半句,像无能;少了后半句,像甩锅。真正的产品问题是可信访问何时从新闻用语变成可申请、可审计的通道——包括谁有资格、日志归谁、越权怎么停。
我会把 85% 当成聊天体验指标,而不是安全边界指标。边界指标仍是:双用途分类是否稳健、Opus 5 回退是否可被诱导绕开、可信访问是否引入独立评测。六到十二个月,若通道仍停留在“我们致力于”,这篇就只是一次分类器调参通告。
[1]