AI 问小创

你好,我是问小创 AI 助手

告诉我你的需求,我帮你从站内挑最合适的 AI 工具。

推荐结果基于站内收录,仅供参考,请以实际工具信息为准。
猜你想问
推荐一些AI写作工具 有什么AI绘画工具? 推荐视频剪辑AI工具
AI
问小创: 告诉我你的需求,我帮你从站内挑最合适的 AI 工具。

安全防护技术获突破 Anthropic解禁Mythos级大模型数周内全量上线

当地时间2026年5月28日,AI大模型头部厂商Anthropic宣布,因安全防护技术取得突破性进展,此前因能力过强、潜藏风险过高被封存的Mythos级别AI模型,将在未来几周内向所有客户全量开放。同日,Anthropic还推出旗舰模型新版本Claude Opus 4.8,该版本已完成多轮基准测试优化,目前已正式上市销售。

配图

在AGI技术快速迭代的过去两年,头部大模型厂商始终面临着能力升级与风险管控的两难:模型的泛化能力越强、能处理的复杂任务越多,其被滥用后可能造成的负面影响也越难预估,而Anthropic此前对Mythos级模型的封存态度,正是行业保守策略的典型代表。

作为全球最早把“AI安全对齐”作为核心研发目标的大模型厂商之一,Anthropic此前曾多次公开表态,Mythos级模型的逻辑推理、任务规划能力已经远超当前市面流通的所有商用大模型,在没有配套完善的安全防护机制的前提下,对外开放极有可能被用于生成诈骗脚本、网络攻击代码等高风险内容,因此仅在内部极小规模的受控环境下开展测试。

此次Anthropic能够推动Mythos级模型开放,核心支撑是其在安全防护技术上的突破性进展。据官方披露,其最新研发的动态对齐防护体系,能够在模型输出的全流程实现实时风险拦截,针对高风险请求的识别准确率达到99.99%,完全满足民用开放的安全标准。

与Mythos级模型的开放预告同步推出的,还有旗下旗舰模型的更新版本Claude Opus 4.8。据官方介绍,该版本已经率先搭载了最新的安全防护模块,针对多项行业主流基准测试完成了深度优化,企业级用户最常用的团队协作、跨文档处理等场景下的任务完成效率得到显著提升,目前该版本已经正式开放付费调用。

在不少行业观察者看来,此次Anthropic解禁高能力模型的动作,打破了此前行业“为了安全限制能力”的固有思路,证明安全技术的同步迭代完全可以匹配模型能力的升级速度,为后续更高能力等级的AGI模型商用落地提供了可参考的实践路径。

不过也有AI安全研究者提示,高能力大模型的开放仍然需要配套的监管规则、用户准入机制共同约束,才能在释放技术红利的同时,最大化降低滥用风险。按照Anthropic的规划,Mythos级模型将优先向经过资质审核的企业级客户开放,后续逐步扩大覆盖范围。

本文基于公开信息分析整理,仅供参考。更多AI工具动态与行业解读,请持续关注本站更新。