AI 问小创

你好,我是问小创 AI 助手

告诉我你的需求,我帮你从站内挑最合适的 AI 工具。

推荐结果基于站内收录,仅供参考,请以实际工具信息为准。
猜你想问
推荐一些AI写作工具 有什么AI绘画工具? 推荐视频剪辑AI工具
AI
问小创: 告诉我你的需求,我帮你从站内挑最合适的 AI 工具。

Anthropic即将推出Claude Mythos新模型 安全隐忧引发行业热议

2026年5月,AI大模型厂商Anthropic被曝正筹备推出新一代大模型Claude Mythos预览版,该产品定位计算机安全任务方向,相较现有旗舰模型Claude Opus 4在代码理解、自主执行能力上实现显著提升。此前有用户在公开产品端短暂看到预览版本入口,目前该入口已下架,模型处于上线前测试阶段,其超强能力引发的安全风险已受到全行业关注。

5月下旬,多名海外Claude用户在产品设置页意外刷到了此前从未公开过的「claude-mythos-1-preview」选项,仅十几分钟后该入口就被官方紧急下架,这一反常操作很快引发了行业对Anthropic新模型的猜测。

根据目前曝光的信息,Claude Mythos的开发最早可追溯到2026年4月初,是Anthropic面向计算机安全场景打造的前沿专用模型。和当前旗舰级通用模型Claude Opus 4相比,该模型在代码理解、多步任务自主执行能力上有量级提升,能够独立完成漏洞挖掘、安全防护方案编写等高复杂度专业任务。
此次入口短暂露出后快速下架,也意味着该模型已经进入上线前的最后测试阶段,距离正式开放小范围预览已经不远。

正是因为该模型的能力远超此前的安全专用模型,Anthropic内部对其开放态度极为谨慎。据内部测试信息显示,该模型已经具备专业级网络攻击能力,能够自主编写恶意代码、寻找系统漏洞,甚至可以独立完成完整的渗透攻击流程。
如果开放范围控制不当,该模型很可能被恶意攻击者利用,大幅降低网络攻击的技术门槛,给全球企业、政府机构的信息安全带来新的挑战。这也是Anthropic并未选择直接全面开放,而是先小范围测试预览的核心原因。

作为业内最早以AI安全对齐为核心竞争力的大模型厂商,Anthropic的谨慎也折射出当前大模型发展的共性矛盾:随着垂直专用大模型的能力不断逼近甚至超过专业人士水平,能力溢出带来的滥用风险正在快速上升。
此前OpenAI、谷歌DeepMind等厂商都曾在安全报告中提及,具备专业领域超强能力的大模型,一旦对齐不到位,可能带来远超通用大模型的危害。未来如何在能力升级和安全可控之间找到平衡点,将是所有大模型厂商要面对的核心考题。
截至发稿,Anthropic尚未对Claude Mythos的上线时间、开放范围做出官方回应,有行业分析师推测,该模型大概率会先面向经过资质审核的网络安全企业、机构用户开放,不会直接对普通C端用户解锁全部能力。

本文基于公开信息分析整理,仅供参考。更多AI工具动态与行业解读,请持续关注本站更新。