问小创
告诉我你的需求,我帮你从站内挑最合适的 AI 工具。
2026年6月,人工智能企业OpenAI正式面向所有ChatGPT登录用户开放全新可选安全设置「封锁模式」,针对智能体时代大模型联网、工具调用能力升级后日益猖獗的提示注入攻击提供防护,避免用户商业机密、个人隐私等敏感数据因恶意指令泄露,该功能已覆盖全部个人账户类型及企业工作区。

过去两年,随着大模型普遍接入联网能力与第三方工具生态,提示注入攻击已经成为企业用户使用生成式AI的最大安全隐患之一。攻击者往往会将恶意指令隐藏在PDF文档、网页源码甚至图片隐写内容中,一旦大模型读取这些被「投毒」的内容,就可能绕过预设的安全对齐规则,在用户无感知的状态下执行数据外传、越权操作等恶意行为。
2025年以来,生成式AI正式进入智能体(Agent)爆发期,包括GPT-4o、Claude 3 Opus在内的主流大模型都升级了多模态交互、自动工具调用能力,可自主完成网页检索、文档处理、API对接等复杂任务,功能边界的扩展也直接放大了安全风险。全球网络安全机构Verizon发布的2026年AI安全报告显示,仅2025年第四季度,针对企业级大模型应用的提示注入攻击就突破了130万次,平均每次攻击造成的企业损失超过12万美元。
面对业内长期难以根治的提示注入攻击问题,OpenAI此次没有走“兼顾功能和安全”的折中路线,反而采用了极致的安全优先策略。开启封锁模式后,ChatGPT将直接禁用所有联网搜索、第三方插件调用权限,对所有外部输入的文档、链接内容进行三重语义校验,只要识别到疑似恶意注入的指令片段,就会直接终止交互,哪怕因此出现正常内容无法读取、任务无法完成的情况也不会放行。
这种“宁可限制功能也不泄露数据”的设计思路,也为不同需求的用户提供了灵活的选择:普通用户日常使用时可以关闭该模式保障体验,处理敏感商业数据、个人隐私内容的用户则可以开启模式获得最高等级的安全防护。
此前大模型厂商的竞争主要集中在推理能力、多模态效果、工具链丰富度上,而OpenAI此次推出封锁模式,标志着头部厂商已经将安全能力放在了和功能体验同等重要的位置。
对于金融、法律、政务等对数据安全要求极高的行业来说,这种可自主选择的分级安全机制,也将进一步降低生成式AI的落地门槛。业内人士预测,未来两年,分级安全设置大概率会成为所有主流大模型的标配功能,行业的竞争焦点也将从“能力强弱”转向“能力与安全的平衡能力”。
AI创作导航,创作与探索并重。聚合全球优质AI工具,覆盖短视频、图文、写作、设计等创作场景,以及办公、学习、编程、生活等全品类需求。从创作出发,探索AI的无限可能,为创作者、学生、教师、职场人提供一站式AI工具导航与场景化应用指南。