在2026年Disrupt全球科技大会的AI安全专场中,AI初创公司Anthropic公布最新研究成果:试图伪装人类身份开展网络活动的恶意AI代理,与普通网民一样对CAPTCHA人机验证存在明显规避倾向,测试数据显示CAPTCHA可拦截超80%的低成熟度恶意AI代理访问,本次大会同时有OpenAI、Replit等企业发布AI安全相关进展。

Disrupt 2026 AI安全分论坛的提问环节,当Anthropic安全研究团队负责人抛出“你最近一次因为CAPTCHA验证放弃访问一个网站是什么时候”的问题时,台下近千名观众几乎都举起了手,而随后公布的研究数据显示,这个让人类头疼了20多年的验证机制,现在同样成了恶意AI代理的“眼中钉”。
近两年来,大语言模型的普及让AI代理的开发门槛大幅下降,黑灰产从业者可以用极低的成本批量生成AI代理,用来爬取平台付费内容、发送诈骗信息、伪造用户评论。2026年上半年的全球互联网安全报告显示,恶意访问请求中已有42%来自各类AI代理,传统的IP封禁、cookie验证等手段几乎失效,行业一直在寻找低成本的通用拦截方案。
Anthropic的研究团队模拟了120种不同技术架构、不同训练程度的恶意AI代理,针对全球TOP500互联网平台的访问流程做了渗透测试,结果显示87%的恶意AI代理会在首次遇到CAPTCHA验证时主动终止访问流程,剩余13%尝试通过验证的代理中,仅不到9%能完成字符识别+图像分类的多模态混合验证。
研究人员解释,出现这一现象的核心原因是成本问题:恶意AI代理单次通过CAPTCHA验证需要消耗的算力,是正常访问的47倍,对于需要批量发起数十万次请求的黑灰产而言,额外的算力成本会让其盈利模型直接崩盘,因此绝大多数恶意代理的开发逻辑里,都会直接将CAPTCHA设为终止访问的触发条件,和人类嫌麻烦主动关掉页面的行为逻辑几乎一致。
在本次Disrupt大会上,除了Anthropic的研究成果,OpenAI、Replit等企业也公布了相关的AI安全布局。其中Replit宣布将为其代码开发平台上线专属CAPTCHA体系,针对AI生成代码的特征做定向验证,降低普通开发者的验证频率;OpenAI则公布了其恶意AI代理识别模型,可以在用户访问的前3个交互步骤判断对方是否为AI,配合CAPTCHA实现分层验证,未来普通人类用户遇到CAPTCHA的频率可能下降60%,而恶意AI代理的拦截率将提升至95%以上。
AI创作导航,创作与探索并重。聚合全球优质AI工具,覆盖短视频、图文、写作、设计等创作场景,以及办公、学习、编程、生活等全品类需求。从创作出发,探索AI的无限可能,为创作者、学生、教师、职场人提供一站式AI工具导航与场景化应用指南。