问小创
告诉我你的需求,我帮你从站内挑最合适的 AI 工具。
近期全球网络安全行业调研显示,2024年由ChatGPT、Google Gemini、DeepSeek等生成式AI工具制作的极端有害内容年同比增幅达327%,其中深度伪造色情、暴力煽动、虚假信息占比超7成,Meta、谷歌等主流内容平台的审核处理效率已落后于有害内容产出速度3倍以上,未成年用户接触风险较2022年提升219%。
今年9月美国全国失踪和受剥削儿童中心(NCMEC)发布的最新报告显示,其2024年上半年收到的儿童性虐待内容举报中,AI生成内容占比已经从2022年的0.2%飙升至34.8%,仅半年的举报量就超过了此前5年的总和。
不同于传统有害内容需要专业制作技能、生产周期长的特点,如今普通人只要借助开源大模型或者公开的AI生成工具,输入简单的提示词就能在几分钟内生成高度逼真的深度伪造视频、批量捏造的虚假信息,甚至还有黑产团队专门微调了不受安全护栏限制的专用大模型,对外提供低成本的有害内容批量生成服务。数据显示,当前AI生成有害内容的平均成本仅为人工制作的1/20,生产效率却提升了近百倍。
面对爆发式增长的AI生成有害内容,现有的内容审核体系已经出现明显的适配漏洞。目前主流平台使用的内容审核模型大多训练于2022年之前的人工生成内容数据集,对AI生成的高仿真深度伪造内容、语义隐蔽的软暴力煽动内容识别准确率不足40%,不少黑产团队还会通过添加肉眼不可见的像素扰动、调整文本表述逻辑等方式绕过审核,进一步提升了识别难度。
人力审核的缺口也在持续扩大。据内容安全行业调研数据,当前主流内容平台的人力审核团队规模仅能覆盖15%的AI生成有害内容,单条有害内容从发布到被处理的平均时长已经从2022年的2.5小时拉长到2024年的18小时,不少有害内容在被删除前已经获得了数十万次的曝光。
目前全球科技行业已经开始探索针对性的解决方案,包括OpenAI、谷歌、DeepSeek、苹果在内的主流大模型厂商都已经在自研生成内容中添加了不可见的溯源水印,部分厂商还在Copilot、Apple Intelligence等C端产品的输出层新增了有害内容识别拦截机制,从生产端降低违规内容流出的概率。
与此同时,全球监管层面也在加快相关规则的落地。欧盟AI法案已经明确将未标注的AI生成有害内容列为违法行为,违规厂商最高可被处以全球年营收6%的罚款,美国、中国等多个国家也在推动建立统一的AI生成内容标识标准,要求公开传播的AI生成内容必须添加明确标识。业内人士指出,只有实现大模型厂商、内容平台、监管部门的全链路协同,才能真正补上当前的内容安全漏洞。
AI创作导航,创作与探索并重。聚合全球优质AI工具,覆盖短视频、图文、写作、设计等创作场景,以及办公、学习、编程、生活等全品类需求。从创作出发,探索AI的无限可能,为创作者、学生、教师、职场人提供一站式AI工具导航与场景化应用指南。