问小创
告诉我你的需求,我帮你从站内挑最合适的 AI 工具。
2026年6月,OpenAI在ChatGPT产品中上线新型语音模型Bidi1灰度测试,目前网页端及移动端用户已可体验相关功能。该模型突破传统AI语音助手线性问答的限制,支持双向并行处理、实时打断插话,交互流畅度接近真人沟通,是AI语音交互领域的重要技术突破,后续OpenAI将启动更大规模测试。

不少近期打开ChatGPT语音功能的用户都发现了明显的体验差异:此前要等AI把整段回答说完才能继续提问,现在哪怕AI还在播报答案,用户随时插话提问,系统都能立刻响应,完全不需要等待上一轮对话结束。这个变化背后,正是OpenAI本次低调上线的Bidi1语音模型。
长期以来,AI语音交互始终受限于线性对话的逻辑桎梏,无论是手机端的智能助手,还是此前版本的ChatGPT语音功能,都严格遵循“用户唤醒-输入指令-AI输出-等待结束”的固定流程。一旦用户中途打断,AI要么无法识别新指令,要么需要用户重新唤醒重复需求,交互体验和真人对话的自然感相差甚远,这也成为语音交互深度落地C端消费场景的最大阻碍之一。
Bidi1语音模型的核心能力在于双向并行处理技术:AI可以在输出语音内容的同时,实时监听、识别用户的新输入,不需要等当前输出完成就可以调度语义理解模块处理新指令,整个响应延迟被压缩到毫秒级,完全实现无缝切换。在公开的测试案例中,当模型正在执行“从1数到10”的任务时,用户随时插话要求“倒数”,模型能够立刻停下原有任务,无缝衔接执行新指令,没有任何卡顿或者需要二次确认的情况。
本次Bidi1的灰度测试,本质上是把AI语音交互的体验门槛拉高到了新的维度。按照OpenAI的产品迭代节奏,若本次测试数据达标,预计最快2026年第三季度就会向全量ChatGPT会员用户开放该功能,后续还可能将Bidi1的API接口开放给第三方开发者,有望带动智能座舱、智能家居、AI客服等多个赛道的语音交互体验实现整体升级,真正让语音交互从“工具式功能”转向“自然化陪伴”。
AI创作导航,创作与探索并重。聚合全球优质AI工具,覆盖短视频、图文、写作、设计等创作场景,以及办公、学习、编程、生活等全品类需求。从创作出发,探索AI的无限可能,为创作者、学生、教师、职场人提供一站式AI工具导航与场景化应用指南。