问小创
告诉我你的需求,我帮你从站内挑最合适的 AI 工具。
2026年4月7日,谷歌正式在iOS平台推出全离线语音听写应用Google AI Edge Eloquent,该产品基于谷歌自研轻量化大模型Gemma构建,可实现100%本地处理语音数据,无需联网即可完成转录、自动剔除语气词、文本润色等功能,既解决了高敏感场景的隐私泄露风险,也填补了离线语音转录智能优化的市场空白。
图源: 图像由AI生成对于经常需要记录会议、采访的职场人而言,语音转写工具的“两难问题”已经存在多年:在线转写怕泄露敏感内容,离线转写又往往输出一堆夹杂语气词的不通顺文本,后续整理成本极高。谷歌此次推出的新产品,直接瞄准了这一长期未被满足的市场需求。
传统语音转写工具分为两类,一类依托云端大模型能力,转写准确率和润色能力出色,但所有音频、文本数据都需要上传至服务器,对于商务谈判、内部战略会、深度访谈等高敏感场景,用户往往不敢轻易使用;另一类为纯离线工具,仅依托基础的自动语音识别(ASR)技术完成转写,输出内容基本是“原汁原味”的口头表达,充斥着“嗯、啊、那个、然后”等无意义助词,平均每小时转录内容需要用户花费20-30分钟时间调整润色,效率提升十分有限。
Eloquent的核心优势,是首次把轻量化大模型的理解能力完全落地到了端侧运行。该应用基于谷歌2024年推出的开源轻量化大模型Gemma定制优化,用户仅需要下载不足200M的ASR模型包,即可实现100%离线运行,所有音频处理、文本生成环节都在本地设备完成,完全不会产生数据上传行为,从技术层面堵上了隐私泄露的可能性。
不同于传统离线工具的机械式转写,搭载大模型能力的Eloquent可精准识别语义逻辑,自动过滤所有无意义语气助词,同时对语序混乱的口头表达进行通顺度润色,直接输出符合书面表达规范的文本内容。据官方测试数据,针对日常会议、访谈场景的中文、英文转录,**Eloquent的有效内容占比可达97%以上,后续编辑时间较传统离线工具减少90%**。
此前端侧AI的落地场景大多集中在影像优化、智能助理等消费级功能,而Eloquent的推出,标志着大模型端侧能力已经能够支撑专业生产力场景的需求。
谷歌方面透露,预计2026年下半年将推出安卓版本的Eloquent,后续还会把相关能力整合进谷歌办公套件Workspace中,为用户提供全链路的本地AI生产力服务。业内分析认为,随着全球各地区数据合规要求不断提升,兼具隐私性、专业性的端侧AI生产力工具,将成为未来1-2年科技巨头布局的核心赛道,C端用户的办公效率也将迎来新一轮的提升。
AI创作导航,创作与探索并重。聚合全球优质AI工具,覆盖短视频、图文、写作、设计等创作场景,以及办公、学习、编程、生活等全品类需求。从创作出发,探索AI的无限可能,为创作者、学生、教师、职场人提供一站式AI工具导航与场景化应用指南。