AI 问小创

你好,我是问小创 AI 助手

告诉我你的需求,我帮你从站内挑最合适的 AI 工具。

推荐结果基于站内收录,仅供参考,请以实际工具信息为准。
猜你想问
推荐一些AI写作工具 有什么AI绘画工具? 推荐视频剪辑AI工具
AI
问小创: 告诉我你的需求,我帮你从站内挑最合适的 AI 工具。

Anthropic发布Claude Fable5 超严安全限制致拒答基础生物题

2026年6月,AI企业Anthropic正式发布面向大众市场的旗舰大模型Claude Fable5,该款Mythos级模型在生物学、网络安全等领域具备行业顶尖能力,但上线后被发现因超严格安全对齐策略,会主动拒答高中水平基础生物学问题,并将请求转接至上一代旗舰Claude Opus4.8,引发行业对AI安全边界的广泛讨论。

配图

不久前,一名AI测评博主发布的测试截图引发了科技圈热议:他向Anthropic最新上线的Claude Fable5提问“请说明花粉症的常见诱发原因”,这一属于高中生物常识范畴的问题,却没有得到预期的科普回答,反而收到了“该领域查询暂不支持直接响应,已为你转接Claude Opus4.8处理”的提示。

不少用户最初以为这是模型的能力bug,但Anthropic官方很快回应称,这一表现是团队刻意设置的安全规则,和模型本身的能力无关。根据此前披露的基准测试数据,Claude Fable5作为Anthropic目前面向大众开放的最强模型,在生物大分子结构预测、网络攻防推演等高阶任务上的表现,较前代Claude Opus4.8提升超过40%,完全有能力轻松回答所有高中阶段的生物问题。

Anthropic团队解释称,由于Claude Fable5的能力已经达到Mythos级,一旦被恶意利用,可能在生物病原体改造、高危化合物合成等领域造成严重安全风险,而当前的安全对齐技术还无法100%精准区分普通科普查询和恶意用途请求,因此团队最终选择了更为保守的防护策略,将整个生物学相关领域列为最高等级安全红线,哪怕会牺牲部分普通用户的使用体验。

事实上,Claude Fable5的“矫枉过正”并非个例,而是当前大模型行业进入高阶能力释放期面临的共性困境。随着大模型的通用能力不断突破,其潜在的滥用风险也在同步上升,全球多个国家和地区已经出台的AI监管法案,都要求通用人工智能厂商对高风险领域的输出做出严格限制。

作为最早提出宪法AI对齐框架的厂商,Anthropic本身就以极高的安全标准著称,其产品策略始终将安全放在用户体验之前。但这一策略也引发了不少争议:有普通用户表示,自己只是需要查询基础的医疗科普知识,却被迫使用能力更弱的前代模型,反而降低了获取信息的效率;也有行业从业者指出,一刀切的限制反而会倒逼有恶意需求的用户转向安全标准更低的开源模型,反而达不到防控风险的目的。

目前,业内已经在探索更精细化的安全对齐方案,试图打破“要么放任风险、要么牺牲体验”的二元困局。包括上下文语义分级识别、用户身份权限核验、高风险操作溯源留痕等技术都在测试当中,未来有望实现对不同用户、不同场景的差异化响应,既堵住恶意滥用的漏洞,又不影响普通用户的正常使用需求。

Anthropic相关负责人也表示,团队正在收集上线后的用户反馈,会逐步优化生物领域的响应规则,未来会逐步放开对科普类、学习类合理查询的支持,在守住安全底线的前提下,尽可能释放Claude Fable5的能力价值。

本文基于公开信息分析整理,仅供参考。更多AI工具动态与行业解读,请持续关注本站更新。