AI 问小创

你好,我是问小创 AI 助手

告诉我你的需求,我帮你从站内挑最合适的 AI 工具。

推荐结果基于站内收录,仅供参考,请以实际工具信息为准。
猜你想问
推荐一些AI写作工具 有什么AI绘画工具? 推荐视频剪辑AI工具
AI
问小创: 告诉我你的需求,我帮你从站内挑最合适的 AI 工具。

Anthropic拟公开上线最强模型Mythos AI安全治理迎来关键拐点

2026年5月,AI公司Anthropic被曝正推进代号为claude-mythos-1-preview的大模型公开上线。这款今年4月7日推出预览版的模型曾因具备自动化零日漏洞挖掘等过强攻防能力被严格限制,此次开放意味着AI安全治理将从过往防御性限制转向主动式工具化,也引发业内对通用AI网络攻防能力边界的广泛讨论。

近日不少海外开发者在Anthropic公开的后端接口迭代日志中发现,此前仅面向极小范围红队测试开放的Claude Mythos模型,已经新增了公开调用的权限配置字段,这款被雪藏多时的超强模型距离正式上线只剩最后一步。

今年4月7日Claude Mythos预览版推出后,就始终笼罩在安全争议的阴影中。和此前主打通用推理、内容创作的Claude系列模型不同,Mythos的核心能力聚焦于网络攻防领域,而非普通的代码编写。

在内部红队测试中,Mythos被证实能够独立发现并利用主流操作系统、浏览器中的未公开零日漏洞,其在复杂攻击链搭建、漏洞利用代码生成上的表现,比现有旗舰模型Claude Opus 4.7高出两个数量级,无需人工辅助即可完成过去专业安全团队数天的工作量。

也正是因为能力过于特殊,Mythos上线后仅对极少数政府网络防御机构、头部企业安全团队开放访问权限,且所有使用者都签署了严格的保密协议,被业内称为Anthropic藏了近一年的“危险底牌”。

过去行业对于这类具备超强攻防能力的大模型,普遍采用“防御性限制”的治理逻辑:严格缩小访问范围、禁止公开能力细节,避免技术被恶意群体利用发起网络攻击。

而此次Anthropic推进Mythos公开上线的动作,意味着AI安全治理逻辑正在发生转变:不再以“限制能力扩散”为核心目标,而是通过技术手段给模型加上权限围栏,将攻防能力定向转化为公开的开发者工具,开放给合法的安全测试场景使用。

据了解,上线后的Mythos将主要面向白帽黑客、企业安全团队提供服务,可用于企业系统漏洞自查、应急响应漏洞修复等场景,相当于把过去只有顶级安全团队才能拥有的攻防能力,变成了可按需调用的标准化工具。

不过Mythos的公开上线也引发了不小的争议。不少网络安全专家表示,即便设置了权限门槛,也很难完全避免能力被黑产、恶意黑客破解盗用,一旦Mythos的零日漏洞挖掘能力被非法利用,很可能引发全球范围的大规模网络攻击潮,给关键信息基础设施带来巨大风险。

也有业内观点认为,只有将AI攻防能力公开给合法的安全从业者,才能更快地发现现有系统的潜在漏洞,提前完成修复,反而会降低整体网络安全风险。截至目前,Anthropic尚未公布Mythos上线后的具体权限管控规则,相关细则的公布将成为决定这款模型最终走向的关键。

本文基于公开信息分析整理,仅供参考。更多AI工具动态与行业解读,请持续关注本站更新。