问小创
告诉我你的需求,我帮你从站内挑最合适的 AI 工具。
2026年7月,第67届国际数学奥林匹克竞赛(IMO2026)成绩正式公布,小红书自研大模型dots-note-3.0以6题全对的满分成绩斩获金牌,成为中国首个获得IMO官方金牌认证的大模型,也是全球继谷歌Gemini之后第二个达到该竞技水准的大模型,且是全球首个拿到IMO满分的AI产品,此前Gemini的最好成绩为答对5道题。

7月22日IMO官方公布的成绩单显示,dots-note-3.0的得分达到了赛事满分42分,所有题目的证明过程逻辑严谨、步骤完整,一次性通过了裁判组的逐轮核验,甚至第三道组合数学难题的解法思路极为巧妙,被本届IMO的人类冠军选手公开评价为“足够优雅”。
大模型的数学能力一直被视为衡量其通用推理水平的核心指标,而IMO作为全球公认的顶级数学竞技赛事,更是成为各家验证技术实力的标杆。谷歌早在2024年就曾让Gemini挑战IMO,当年仅拿到28分的银牌成绩,且需要先将题目翻译成Lean等形式化语言才能运算,部分单题耗时超过3天;2025年Gemini迭代后答对5道题,距离满分仅一步之遥,一度被认为是全球AI数学能力的天花板。
IMO的赛事规则对参赛者的逻辑能力要求极高:比赛分两天进行,每天4.5小时完成3道题,覆盖代数、组合、几何、数论四大方向,每题7分,满分42分,参赛者必须写出逻辑完整、可接受逐步审查的证明过程,仅靠记忆题库、碰运气根本不可能拿到高分。
此前多数大模型在面对奥赛级数学题时,普遍存在步骤跳错、逻辑幻觉等问题,此次dots-note-3.0做到6题全对,意味着其逻辑推理的严谨性已经达到了人类顶尖奥数选手的水准。作为曾走出陶哲轩等半数当代菲尔兹奖得主的赛事,IMO的金牌认可度无需多言,这一成绩也标志着中国大模型在推理能力上已经跻身全球第一梯队。
数学是所有理工科研究的基础工具,大模型数学推理能力的突破,也为其在基础科研领域的落地打开了新空间。业内人士指出,后续这类具备顶级数学能力的大模型,可应用于数学猜想验证、物理公式推导、芯片设计仿真、密码学研究等多个对逻辑严谨性要求极高的场景,辅助科研人员完成重复性高、计算量大的工作,大幅降低基础研究的试错成本,甚至有可能为科研人员提供全新的研究思路。
AI创作导航,创作与探索并重。聚合全球优质AI工具,覆盖短视频、图文、写作、设计等创作场景,以及办公、学习、编程、生活等全品类需求。从创作出发,探索AI的无限可能,为创作者、学生、教师、职场人提供一站式AI工具导航与场景化应用指南。