问小创
告诉我你的需求,我帮你从站内挑最合适的 AI 工具。
当地时间2026年4月6日,谷歌在iOS平台低调上线实验性语音输入应用Google AI Edge Eloquent。该产品搭载谷歌Gemma4系列自动语音识别模型,主打边缘侧离线运行、智能去杂润色功能,可实时将口语转化为专业文本。此举标志着谷歌正式入局由Wispr Flow、SuperWhisper领跑的高端AI语音转文字赛道。
图源: 图像由AI生成近年远程办公、播客创作、学术采访等场景的普及,让AI语音转文字从小众工具变为大众刚需。但绝大多数主流转写产品依赖云端计算,用户语音数据需要上传至服务商服务器处理,隐私泄露风险始终是悬在用户头上的达摩克利斯之剑。
此前主打离线运行、高准确率的高端转写赛道基本由Wispr Flow、SuperWhisper两家主导,普遍采用月付30-50元的订阅模式,用户门槛不低。谷歌此次以免费实验性产品切入,直接冲击现有市场定价体系。
Google AI Edge Eloquent的核心能力来自于谷歌最新推出的Gemma4系列(E2B/E4B规格)自动语音识别模型,依托边缘AI技术,所有转写计算完全在用户手机本地完成,无需联网上传任何数据。**用户仅需在首次使用时下载对应语言的模型包,即可实现毫秒级低延迟转写,即便在飞机、地下室等无网场景下也能正常使用**。
除了基础的语音转文字功能,该应用还搭载了智能润色模块,可自动过滤“嗯、啊”等语气助词和口误重复内容,还支持“要点提炼”“正式公文”“日常备忘”等多风格输出,一键生成符合场景需求的文本内容。
此次谷歌推出离线听写应用,本质是其Gemma开源大模型生态向C端场景落地的重要尝试。业内分析认为,谷歌先以实验性免费产品测试用户反馈,后续极有可能将同款转写能力整合到Gboard输入法、谷歌文档、Meet会议等自有产品矩阵中,甚至开放API给第三方开发者,进一步扩大Gemma生态的市场覆盖率。
目前该产品仅在iOS端开放测试,后续是否会登陆安卓平台、是否会增加多语言支持(包括中文),仍是用户最关注的核心问题。
AI创作导航,创作与探索并重。聚合全球优质AI工具,覆盖短视频、图文、写作、设计等创作场景,以及办公、学习、编程、生活等全品类需求。从创作出发,探索AI的无限可能,为创作者、学生、教师、职场人提供一站式AI工具导航与场景化应用指南。