AI 问小创

你好,我是问小创 AI 助手

告诉我你的需求,我帮你从站内挑最合适的 AI 工具。

推荐结果基于站内收录,仅供参考,请以实际工具信息为准。
猜你想问
推荐一些AI写作工具 有什么AI绘画工具? 推荐视频剪辑AI工具
AI
问小创: 告诉我你的需求,我帮你从站内挑最合适的 AI 工具。

百川智能联合清华发布Baichuan-M4 登顶医疗评测超GPT-5.5

2026年6月,百川智能联合清华大学研究团队正式发布新一代医疗增强大模型Baichuan-M4。该模型在权威医疗评测HealthBench及Hard、Professional两个子榜单中全部夺冠,医疗领域专业性能超越GPT-5.5,核心突破为模拟真人医生的主动问诊交互模式,为AI在临床辅助决策等医疗垂直场景落地提供了新的技术路径。

作为全球公认准入门槛最高的医疗大模型专业评测体系,HealthBench的考题覆盖临床问诊、病例分析、诊疗方案制定等全流程医疗场景,其中Hard、Professional两个子榜单更是分别针对疑难罕见病识别、诊疗合规性判断设置了极高的专业门槛,此前头部位置长期被海外通用大模型占据。本次Baichuan-M4不仅拿下总榜第一,在两个子榜单的得分也分别领先GPT-5.5 8.2个、6.9个百分点,是首个在该评测全赛道登顶的国产大模型。

过往面向医疗场景的大模型大多停留在“用户提问-模型应答”的被动交互模式,很容易因为患者遗漏病史、症状描述模糊等问题出现判断偏差。而Baichuan-M4的核心进化,是把全科室临床诊疗路径内嵌到了模型的推理链路中,实现了类真人医生的主动问诊能力。
目前模型已覆盖12个临床科室近万种病症的标准问诊逻辑,当患者输入初步症状后,模型会自主识别潜在病情线索,针对性追问病史、既往用药史、伴随症状等关键信息,还能同步交叉验证用户描述的一致性,大幅降低漏诊、误诊概率。

随着通用大模型的性能迭代进入平缓期,医疗、工业、法律等垂直场景的落地能力,已经成为大模型厂商的核心竞争壁垒。
作为国内头部大模型厂商,百川智能此前已经在医疗赛道布局多年,先后推出的Baichuan-M系列前序产品,已经在国内多家医疗机构的病历结构化整理、医学文献检索、健康咨询等场景落地应用。本次Baichuan-M4的推出,也补上了国产医疗大模型在交互端的能力短板,进一步缩小了与海外顶尖大模型在垂直领域的性能差距。

尽管性能表现亮眼,但医疗AI的正式落地仍需要满足严格的监管要求。据了解,目前Baichuan-M4已经启动国家三类医疗器械的注册申报工作,同步正在和国内十余家三甲医院开展临床验证,后续将优先落地基层医疗机构预问诊、家庭医生辅助决策、在线健康咨询等场景。
业内人士指出,医疗大模型的核心定位始终是医生的辅助工具,而非替代医护人员,其大规模应用有望进一步降低基层诊疗的门槛,缓解优质医疗资源分布不均的问题。

本文基于公开信息分析整理,仅供参考。更多AI工具动态与行业解读,请持续关注本站更新。