Chrome 149原生集成Gemini 3.5 Flash 推出框选即问AI交互功能

2026年6月谷歌正式推送Chrome 149浏览器版本,原生深度集成Gemini 3.5 Flash大模型,上线「从屏幕选择」交互功能,用户可直接框选网页局部文本、图片内容发起AI定向对话,无需切换工具或全局上传内容,浏览场景下AI交互精准度、效率均有显著提升,是桌面端浏览器AI原生能力落地的重要进展。

配图

不少用户在浏览网页时都遇到过类似场景:遇到看不懂的专业公式、想分析的局部设计图,或是需要翻译的外文段落,要么得手动截图上传到AI工具,要么复制文本切换对话窗口,来回跳转十分繁琐。而谷歌最新的Chrome版本更新,直接把这个多步操作压缩到了两步之内。

根据谷歌官方更新说明,用户开启Chrome侧边栏的Gemini功能后,点击「从屏幕选择」按钮,光标即可变为选区状态,自由勾勒网页内任意区域的文本、图像内容,被选中的内容会自动作为上下文附件加载到Gemini的输入框中,用户输入问题就能直接获得针对该局部内容的回答。

全程无需离开当前浏览页面,也不会像传统网页搜索那样跳转到结果列表页。该操作逻辑和用户熟悉的Google Lens有相似之处,但核心差异在于无需跳转搜索,直接落地对话式交互,精准度远高于此前的全网页AI分析功能——后者经常会混入页面广告、侧边栏推荐等无关内容干扰AI判断。

这次功能落地的核心前提,是Gemini 3.5 Flash的多模态能力和低延迟特性。作为谷歌面向端侧场景优化的轻量级大模型,Gemini 3.5 Flash兼顾图像、文本理解能力和响应速度,原生集成在Chrome内核中后,用户框选内容的识别、上传、上下文拼接全流程平均耗时不到1秒,比手动截图上传到第三方AI工具的流程缩短了70%以上,几乎不会打断用户的正常浏览节奏。

目前该功能已经对全球所有Chrome 149用户开放,支持包括中文在内的100余种语言的内容识别和对话。

近年来,桌面浏览器已经成为科技巨头布局C端AI入口的核心赛道,微软Edge早早就将Copilot原生集成到浏览器功能中,国内多家厂商也推出了自带AI对话能力的浏览器产品。此前各家的AI功能大多集中在全网页总结、翻译等通用场景,而谷歌此次推出的局部框选交互,把AI能力的颗粒度细化到了网页的任意局部内容,本质是在降低用户调用AI的门槛——从“需要主动打开AI工具”变成“浏览过程中随时可以唤起”。

后续谷歌还计划开放相关API,允许第三方网页开发者调用该框选交互能力,为用户提供定制化的AI服务,比如电商场景下框选商品即可触发AI比价,教育场景下框选知识点即可生成配套练习题等。从全网页交互到局部框选交互,浏览器的AI原生能力正在不断贴近用户的真实使用场景,接下来随着端侧大模型性能的进一步提升,类似的轻量AI交互功能大概率会成为桌面端软件的标配。

本文基于公开信息分析整理,仅供参考。更多AI工具动态与行业解读,请持续关注本站更新。