如何评价 Claude Fable 5 全球暂停访问?
文艺频道··4 min read
说实话,看到这个消息的第一反应是:果然来了。 不是马后炮,但在 AI 能力疯狂迭代的当下,突然叫停某个版本的全球访问,基本只有两种可能——要么是技术上出了惊天大 bug,要么是伦理安全触到了红线。 Claude Fable 5 我没记错的话,是 Anthropic 在“对齐”方向上的又一次激进尝试。...
说实话,看到这个消息的第一反应是:果然来了。
不是马后炮,但在 AI 能力疯狂迭代的当下,突然叫停某个版本的全球访问,基本只有两种可能——要么是技术上出了惊天大 bug,要么是伦理安全触到了红线。
Claude Fable 5 我没记错的话,是 Anthropic 在“对齐”方向上的又一次激进尝试。它最大的卖点是“更安全、更可控”,甚至能在对话中就帮你纠偏思路。但现在全球暂停访问,说明这个卖点本身出了问题。
我猜,大概率是它“太安全”了,以至于开始锁死正常对话。
举个例子:之前有用户反映,让 Claude 写个简单的递归函数,它竟然主动拒绝了,理由是“可能被用于开发不安全的递归算法”。这种过度泛化的安全策略,放在实验室里是严谨,放在产品里就是灾难。作为内容创作者,我最怕的就是这种“爹味”纠正——你还没说完,它先给你上一课。

更让我在意的是“全球暂停”这几个字。一般的 bug 修复只需区域下架或灰度回滚,全球暂停意味着问题已经波及到所有语言、所有用户,底层架构级风险。Anthropic 向来以“负责任”自居,但这次的操作反而暴露了他们的焦虑:为了让模型无懈可击,反而制造了更难以预测的脆弱性。
说到底,AI 的安全不该是锁链,而是护栏。 锁链把人捆死在原地,护栏才能让人放心奔跑。Claude Fable 5 试图做护栏,结果做成了锁链——连程序员写个 for 循环都要被审查,这不叫安全,这叫窒息。

现在暂停了,或许对 Anthropic 是好事。赶紧回去把“安全阈值”调低一点,把“对齐”改成“对话”,而不是“训话”。毕竟用户要的是助手,不是道德审查官。
反正我暂时继续用 GPT 了,至少它不会在我写文案时突然弹出“本回复包含可能引发社会争议的比喻,请重新表述”。——这谁受得了?