问小创
告诉我你的需求,我帮你从站内挑最合适的 AI 工具。
近日,AI大模型厂商Anthropic正式推出Claude Fable 5.1与Claude Mythos 5.1两款新一代大语言模型。两款模型在科研专用基准Terminal-Bench-Science中得分达52.6%,同时缓存读取成本较前代下降75%,同步推出的还有适配新模型的API调整方案,将为科研、企业级用户带来更高性价比的大模型使用选择。

2026年以来,大模型行业的竞速焦点已经从通用能力跑分转向专业场景的落地能力,其中科研场景因为对推理精度、上下文处理能力要求高,成为头部厂商抢占的核心赛道。Anthropic此次的新品发布,正是瞄准了这一高速增长的细分市场的核心痛点。
此前,多数主流大模型在科研场景的表现始终存在明显短板,涉及复杂公式推导、实验结果复现、跨学科文献整合等任务时,准确率普遍不足40%,同时高频调用产生的高额成本,也让不少中小科研团队难以负担长期使用大模型的开支。
根据行业调研数据,2026年全球科研领域对大模型的采购需求同比增速已经超过210%,远高于通用大模型市场37%的增速,这也迫使头部厂商加速推出针对性的产品迭代。
此次发布的两款新模型最受关注的升级,集中在科研能力和调用成本两个维度。在衡量大模型科研推理能力的核心基准Terminal-Bench-Science中,两款新模型得分达到52.6%,较上一代Claude 3.5系列提升超过18个百分点,已经接近入门级科研人员的平均推理水平。
成本端的优化同样亮眼,新模型的缓存读取成本较前代下降75%,对于需要反复调用历史实验数据、长文档上下文的科研场景来说,这一调整将直接把用户的长期调用成本降低60%以上。
Anthropic同时同步更新了API接口规则,新的调用逻辑将更好适配科研场景下的多轮复杂交互需求,不过官方也提示现有用户需要对原有调用代码进行小幅适配,才能完全解锁新模型的全部性能。
在此次新品发布之前,OpenAI、DeepSeek等头部厂商也先后推出了针对科研、代码场景的专项大模型,降价幅度普遍在30%-50%之间。Anthropic此次将成本下调幅度提升到75%,也标志着大模型行业的竞争已经从单纯的性能竞赛,转向性能与性价比的综合比拼。
业内分析认为,随着头部厂商陆续释放性能提升、成本下降的利好,未来2-3年内大模型在科研领域的渗透率将从当前的12%提升到40%以上,更多中小科研团队将能够享受到AI技术带来的效率提升。
AI创作导航,创作与探索并重。聚合全球优质AI工具,覆盖短视频、图文、写作、设计等创作场景,以及办公、学习、编程、生活等全品类需求。从创作出发,探索AI的无限可能,为创作者、学生、教师、职场人提供一站式AI工具导航与场景化应用指南。