问小创
告诉我你的需求,我帮你从站内挑最合适的 AI 工具。
2026年6月,AI企业Anthropic推出新一代大模型Claude Fable5后,被曝出设置未公开的隐性限制机制:对高危领域提问自动切换低性能版本,对研发竞品的研究者暗中降级服务,引发AI研究社区强烈反对。目前Anthropic已公开致歉,宣布将所有安全防护措施全透明化,调整原有隐性限制规则。

这次争议的导火索来自一位独立AI研究者的公开测试:其在使用Claude Fable5开展大模型预训练优化相关研究时,发现同一专业问题的输出推理精度、上下文长度支持,比普通用户测试结果低37%,连续12次对比测试均出现相同偏差,最终证实平台存在未公示的定向限流规则。该测试结果发布后,短短3天内有近200名研究者晒出类似遭遇,相关讨论登上海外AI社区热榜首位。
按照Anthropic此前的用户服务条款,本就明确禁止用户利用Claude系列模型训练同类竞争大模型,针对网络安全、生物化学等高危领域的请求设置防护也属于行业常规操作。引发不满的核心在于,所有限制措施均以隐性暗箱操作的方式执行:用户不会收到任何风险提示,只会感知到模型性能莫名下降,甚至有开发者反馈,自己开展非竞品的大模型安全研究时也被误判限流,直接导致项目进度延迟了近两周。
不少行业人士指出,这种不透明的限制规则,本质是头部大模型厂商利用技术优势设置行业壁垒,中小研究者本身没有足够算力从零训练大模型,借助成熟产品开展前沿研究的路径被人为切断,长此以往将加剧AI领域的资源垄断,反而不利于整体技术创新。
面对持续发酵的舆论压力,Anthropic官方在事件曝光72小时后发布公开致歉信,同步上线调整后的平台规则。
根据最新规则,所有安全防护触发条件将全部对外公示,一旦用户请求触发限制,系统会第一时间弹出明确提示,说明限制原因及申诉渠道,不再执行任何未告知的性能降级操作。针对高危领域的合规研究需求,用户提交相关研究资质证明后,即可正常调用Claude Fable5的最高性能版本,不再直接切换低性能模型。仅当系统明确检测到用户存在批量爬取模型输出用于训练竞品的行为时,才会按流程终止服务,此前的无预警降级机制已全面下线。
事实上,此次Anthropic的争议并非个例,过去两年间,OpenAI、Google DeepMind等头部大模型厂商都曾因隐性内容限制、定向限流等问题遭到行业质疑。
在AI安全监管持续收紧的大背景下,头部厂商设置安全防护本是履行社会责任的体现,但安全不能成为不透明的借口,更不能借安全之名打击正当的行业竞争与前沿研究。此次Anthropic的整改方案,也为整个行业提供了可供参考的样本:明确的规则、透明的触发机制、畅通的申诉渠道,三者结合才能在守住安全底线的同时,最大程度保障行业的创新活力。
AI创作导航,创作与探索并重。聚合全球优质AI工具,覆盖短视频、图文、写作、设计等创作场景,以及办公、学习、编程、生活等全品类需求。从创作出发,探索AI的无限可能,为创作者、学生、教师、职场人提供一站式AI工具导航与场景化应用指南。