AI 问小创

你好,我是问小创 AI 助手

告诉我你的需求,我帮你从站内挑最合适的 AI 工具。

推荐结果基于站内收录,仅供参考,请以实际工具信息为准。
猜你想问
推荐一些AI写作工具 有什么AI绘画工具? 推荐视频剪辑AI工具
AI
问小创: 告诉我你的需求,我帮你从站内挑最合适的 AI 工具。

Anthropic正式推出Claude Mythos Fable5模型 分级安全机制落地

人工智能企业Anthropic于2026年6月10日正式公开发布旗下Claude Mythos系列全新Fable5大模型,该模型此前因安全顾虑仅对少数合作方开放内测,本次上线同步落地分级过滤机制,敏感领域查询将转由低阶模型处理。同时Anthropic通过Project Glasswing计划为15国超200家合作组织提供无限制高阶版本,美国政府参与了其安全评估工作。

配图

作为OpenAI在通用大模型赛道的核心竞争对手,Anthropic旗下Mythos系列模型的能力始终是行业关注的焦点。因具备极强的关键基础设施漏洞识别能力,该系列模型此前仅面向不到30家核心合作伙伴开放封闭测试,外界对其具体参数、落地路径的猜测已持续数月。

本次面向公众开放的Fable5是Claude Mythos系列首次公开亮相的旗舰模型,其核心创新点在于配套落地的分级过滤机制。

不同于此前大模型普遍采用的全量内容拦截方案,Fable5会先对用户查询的安全等级进行分类:普通场景的需求将直接调用Fable5的全能力输出,而涉及网络安全、生物研发、化学合成等高度敏感领域的查询,系统会自动将请求重定向至能力更低的低阶模型处理,从根源上避免高阶模型能力被滥用。

在公开发布大众版本的同时,Anthropic也为Project Glasswing计划的合作方开放了无任何能力限制的高阶版本。

该计划主要面向全球范围内的政企客户、网络安全服务商开放,目前合作网络已经扩容至覆盖15个国家的约200家组织,美国政府也深度参与了Fable5模型的全流程安全评估工作。据了解,无限制版本的Fable5目前仅允许用于白帽漏洞挖掘、关键基础设施安全防护等合规场景,合作方需签署严格的使用授权协议。

过往高阶大模型的落地始终面临两难困局:完全开放容易引发安全风险,全面限制又会阻碍技术价值的释放。Anthropic本次推出的分级供给方案,为行业提供了全新的治理思路。

随着大模型能力边界不断向专业领域延伸,针对不同用户群体、不同使用场景匹配不同等级的模型权限,有望成为未来高阶大模型落地的主流方案,在保障技术安全的同时最大化释放生产力价值。

本文基于公开信息分析整理,仅供参考。更多AI工具动态与行业解读,请持续关注本站更新。