谷歌Gemini迎重大功能更新 可生成视频自主完成多类数字任务

近日谷歌旗下大模型产品Gemini推送2024年下半年最大规模功能更新,新增原生AI视频生成、晨间事务简报、后台离线批量处理三大核心能力,据官方披露该更新已面向所有Gemini Advanced付费用户全量推送,早期灰度测试数据显示,用户日均处理零散数字琐事的耗时可降低62%,大幅提升日常信息处理效率。

不少Gemini付费用户近日打开客户端时,都会在首页显眼位置发现新增的“后台任务调度”独立入口——不同于以往所有操作都需要用户保持对话界面活跃的限制,现在用户提前设定好触发规则后,哪怕完全退出应用,模型也能在后台按预设逻辑走完多步操作流程。

此前谷歌自研的文生视频模型Veo一直处于小范围邀请测试阶段,本次更新直接将高清视频生成能力原生嵌入Gemini全链路能力中,用户无需跳转第三方工具,仅通过文本指令、图文混合输入,就能生成最长2分钟的无水印1080P高清视频。

该能力最实用的场景之一,就是支持批量异步生成:用户可以一次性上传数十条不同的脚本需求,设定好在闲时(比如深夜用户休息时段)跑完全部生成任务,第二天打开Gemini就能直接拿到全部成品素材,生成效率比当前市面主流的第三方AI视频工具高出3倍左右。

本次上线的晨间简报功能,彻底打破了过去AI助手信息汇总的局限性。用户只需要提前完成授权,让Gemini接入自己的邮箱、日程表、RSS订阅源和工作待办清单,设定好期望的推送时间,模型就会在指定时间前自动完成全量信息梳理,把隔夜未读重要邮件、当日行程风险提示、关注领域的精选行业资讯整合成逻辑清晰的结构化简报,无需用户手动逐一打开多个APP查看。

而后台离线任务的开放,更是覆盖了大量此前大模型很难落地的细碎场景:批量整理云盘内的杂乱文件并自动分类命名、从一周的工作群聊天记录里自动提取项目进度信息汇总成周报初稿、批量筛选收件箱里的推广邮件并归档到指定文件夹……这些以往要耗费用户一两个小时的数字琐事,现在都可以交给Gemini在用户无需操作的时段自主完成。

近半年来全球头部大模型厂商的竞争,已经逐渐脱离了参数比拼、跑分刷榜的早期阶段,转向面向真实用户场景的实用能力落地。从OpenAI推出的GPTs自定义助手,到微软Copilot不断拓展的系统级操作权限,各家都在试图让大模型从“问答工具”进化成能代劳复杂事务的专属助理。

谷歌这次Gemini的功能更新,相当于直接把“异步后台执行”的体验拉到了新的行业基准线,过去很多用户反馈的大模型“一次只能响应一个指令、没法批量完成长流程任务”的痛点,得到了针对性的解决。据谷歌相关产品负责人透露,后续Gemini还将开放自定义任务模板的第三方生态,允许开发者上传预设好的通用事务处理模板,普通用户可以一键调用模板完成复杂配置,进一步降低使用门槛。

可以预见,未来一年内,支持离线批量执行、自主完成全流程数字任务将会成为高端大模型产品的标配能力,AI对用户日常效率的提升,也将从“辅助生成内容”进一步深入到“代劳琐事”的更深层级。

本文基于公开信息分析整理,仅供参考。更多AI工具动态与行业解读,请持续关注本站更新。