问小创
告诉我你的需求,我帮你从站内挑最合适的 AI 工具。
2026年5月21日,网易有道正式发布子曰大模型4.0全模态版本,宣布将核心27B多模态模型、语音合成(TTS)引擎全面开源。该版本中文纯文本数理难题准确率达81.4%,拿下同参数规模SOTA成绩,还实现3秒情感语音克隆,重构后的翻译模块同步实现质量与效率双升,将为AI教育领域开发者提供高适配性的开源底座。
近两年来国内大模型开源赛道的供给持续丰富,但绝大多数开源底座优先面向通用交互场景,想要落地到教育、专业内容生产等垂直领域,开发者往往需要投入大量算力进行专项微调,落地成本居高不下。本次网易有道选择将沉淀多年的垂直场景模型全面开源,恰好补上了此前赛道中缺失的高适配性教育向开源底座。
作为国内最早布局教育AI的企业之一,网易有道此前的子曰系列大模型,已经深度应用在旗下学习机、词典笔、AI课堂等数十款教育产品中,经过了过亿用户的长期实际场景验证。
本次开源的子曰4引擎放弃了通用大模型“全能力摊平”的优化思路,所有技术迭代都优先围绕教育场景的高频需求设计,既降低了普通开发者的二次开发门槛,也能保障面向C端用户的实际使用体验不会出现通用模型常见的“幻觉”问题。
本次开源的27B参数多模态模型,最核心的优势集中在视觉与数理交叉的难题处理领域。在同等参数规模的所有公开模型中,子曰4拿下了视觉数理任务的SOTA成绩,面对带几何图形、函数图表、理化实验装置图的复杂题目,无需提前拆分图文内容就能直接完成识别、推理、输出完整解题步骤。
对应的纯文本数理能力同样处于行业领先水平,81.4%的中文纯文本数理难题准确率远超同级别开源模型的平均表现,完全覆盖从小学到高中阶段的绝大多数理科考点。
同步开源的TTS引擎则实现了3秒零样本情感音色克隆,仅需要3秒的目标人声素材,就能快速复刻对应音色的情绪起伏、停顿习惯甚至地域方言特征,适配AI口语陪练、有声教辅内容生成等场景的效率提升了数倍。此外经过深度重构的翻译模型,教育类专业术语识别准确率提升17%,推理速度同步上涨20%,在课件翻译、外文文献解析场景的表现大幅优于上一代版本。
随着子曰4核心引擎的全面开源,中小AI创业团队、教育机构不再需要投入动辄数千张GPU的成本从零训练专属模型,仅需要少量的微调操作,就能快速上线数理答疑、AI口语测评、多模态互动教辅等创新产品。
据网易有道团队透露,后续他们会在国内外主流开源平台同步更新全量模型权重,还将配套开放面向教育场景的微调工具链、示例数据集,进一步降低垂直领域AI创新的准入门槛,推动优质的AI教育服务下沉到更多普通用户的学习场景中。
AI创作导航,创作与探索并重。聚合全球优质AI工具,覆盖短视频、图文、写作、设计等创作场景,以及办公、学习、编程、生活等全品类需求。从创作出发,探索AI的无限可能,为创作者、学生、教师、职场人提供一站式AI工具导航与场景化应用指南。