AI 问小创

你好,我是问小创 AI 助手

告诉我你的需求,我帮你从站内挑最合适的 AI 工具。

推荐结果基于站内收录,仅供参考,请以实际工具信息为准。
猜你想问
推荐一些AI写作工具 有什么AI绘画工具? 推荐视频剪辑AI工具
AI
问小创: 告诉我你的需求,我帮你从站内挑最合适的 AI 工具。

OpenAI全量开放ChatGPT封锁模式 对抗提示注入攻击风险

2026年6月,人工智能企业OpenAI正式面向所有ChatGPT登录用户开放全新可选安全设置「封锁模式」,针对智能体时代大模型联网、工具调用能力升级后日益猖獗的提示注入攻击提供防护,避免用户商业机密、个人隐私等敏感数据因恶意指令泄露,该功能已覆盖全部个人账户类型及企业工作区。

配图

过去两年,随着大模型普遍接入联网能力与第三方工具生态,提示注入攻击已经成为企业用户使用生成式AI的最大安全隐患之一。攻击者往往会将恶意指令隐藏在PDF文档、网页源码甚至图片隐写内容中,一旦大模型读取这些被「投毒」的内容,就可能绕过预设的安全对齐规则,在用户无感知的状态下执行数据外传、越权操作等恶意行为。

2025年以来,生成式AI正式进入智能体(Agent)爆发期,包括GPT-4o、Claude 3 Opus在内的主流大模型都升级了多模态交互、自动工具调用能力,可自主完成网页检索、文档处理、API对接等复杂任务,功能边界的扩展也直接放大了安全风险。全球网络安全机构Verizon发布的2026年AI安全报告显示,仅2025年第四季度,针对企业级大模型应用的提示注入攻击就突破了130万次,平均每次攻击造成的企业损失超过12万美元。

面对业内长期难以根治的提示注入攻击问题,OpenAI此次没有走“兼顾功能和安全”的折中路线,反而采用了极致的安全优先策略。开启封锁模式后,ChatGPT将直接禁用所有联网搜索、第三方插件调用权限,对所有外部输入的文档、链接内容进行三重语义校验,只要识别到疑似恶意注入的指令片段,就会直接终止交互,哪怕因此出现正常内容无法读取、任务无法完成的情况也不会放行。

这种“宁可限制功能也不泄露数据”的设计思路,也为不同需求的用户提供了灵活的选择:普通用户日常使用时可以关闭该模式保障体验,处理敏感商业数据、个人隐私内容的用户则可以开启模式获得最高等级的安全防护。

此前大模型厂商的竞争主要集中在推理能力、多模态效果、工具链丰富度上,而OpenAI此次推出封锁模式,标志着头部厂商已经将安全能力放在了和功能体验同等重要的位置。

对于金融、法律、政务等对数据安全要求极高的行业来说,这种可自主选择的分级安全机制,也将进一步降低生成式AI的落地门槛。业内人士预测,未来两年,分级安全设置大概率会成为所有主流大模型的标配功能,行业的竞争焦点也将从“能力强弱”转向“能力与安全的平衡能力”。

本文基于公开信息分析整理,仅供参考。更多AI工具动态与行业解读,请持续关注本站更新。