问小创
告诉我你的需求,我帮你从站内挑最合适的 AI 工具。
9月7日,宇树科技正式发布技术突破成果,基于自研UnifoLM-X2-1.0大模型,实现全球首次由世界模型实时驱动的全自主人形机器人格斗,攻克了世界-动作大模型在瞬时规划、动态交互执行领域的技术瓶颈,验证了世界模型驱动人形机器人落地的可行性。同期OpenAI CEO奥尔特曼也证实公司正在推进人形机器人研发,赛道热度持续攀升。

不同于此前人形机器人演示中常见的预设动作脚本,此次宇树科技公开的格斗测试中,两台人形机器人的所有格挡、出击、闪避动作均未经过人工预编程,完全由世界模型根据对手的实时动作自主预判、瞬时决策生成,全程响应延迟控制在毫秒级,完全符合真实格斗场景的交互要求。
此次突破的核心载体是宇树自研的UnifoLM-X2-1.0世界-动作大模型,重点解决了此前通用大模型在机器人控制场景下存在的决策延迟高、动态适配性差的痛点,能够在高干扰、强交互的未知环境中,持续对未来1-3秒的场景状态做出预测,并同步生成最适配的本体控制动作。
几乎与宇树科技发布成果同期,OpenAI CEO萨姆·奥尔特曼公开证实,公司正在并行推进人形机器人与数据中心特种机器人的研发工作。奥尔特曼明确表示,机器人的形态并非研发核心,具备实时感知、决策能力的机器人大脑才是决定行业落地进度的关键,这一判断与宇树科技的技术路线高度契合。
从全球范围来看,此前人形机器人的研发大多集中在本体硬件的迭代上,而随着大模型技术的成熟,以世界模型为核心的“软件定义机器人”正在成为行业共识,仅2026年上半年,全球机器人领域与世界模型相关的融资额就突破了120亿美元,同比增长超过210%。
宇树科技方面表示,此次格斗场景的测试成功,首次验证了世界模型直接驱动人形机器人完成高难度动态任务的可行性,打破了此前行业对“世界模型无法实时控制实体硬件”的普遍质疑。
在落地层面,目前市面上的商用人形机器人大多仅能执行搬运、引导、固定点位巡检等预设任务,对环境变化的适配能力极弱。而随着世界模型与本体控制技术的进一步融合,未来人形机器人将有望进入应急救援、柔性生产、家庭服务等需要随机应变的复杂交互场景,市场规模有望在2030年突破万亿美元大关。
AI创作导航,创作与探索并重。聚合全球优质AI工具,覆盖短视频、图文、写作、设计等创作场景,以及办公、学习、编程、生活等全品类需求。从创作出发,探索AI的无限可能,为创作者、学生、教师、职场人提供一站式AI工具导航与场景化应用指南。