AI 问小创

你好,我是问小创 AI 助手

告诉我你的需求,我帮你从站内挑最合适的 AI 工具。

推荐结果基于站内收录,仅供参考,请以实际工具信息为准。
猜你想问
推荐一些AI写作工具 有什么AI绘画工具? 推荐视频剪辑AI工具
AI
问小创: 告诉我你的需求,我帮你从站内挑最合适的 AI 工具。

谷歌发布Gemini Omni 1.1 Flash 4K视频生成模型能力全面升级

当地时间2026年8月27日,谷歌正式推出新一代视频生成AI模型Gemini Omni 1.1 Flash,最高支持4K超高清视频输出,在场景扩展、运镜控制、生成效率等维度实现全面升级,单次可扩展10秒视频,累计生成最长可达40秒,支持3秒参考片段维持画面一致性,主要面向开发者及专业内容创作者,推动多模态视频生成向高清长时方向演进。

配图

近两年,全球大模型厂商的多模态能力竞争早已越过文本、图像的成熟赛道,转向视频生成这一技术门槛更高的细分领域。此前行业内已落地的视频生成模型普遍存在分辨率上限低、生成时长短、画面逻辑一致性差、运镜不可控等痛点,始终无法满足专业内容创作者的商用需求。

此次谷歌推出的Gemini Omni 1.1 Flash,核心升级首先瞄准了画质痛点,最高支持4K超高清分辨率直出,无需后期放大即可适配专业内容的分发要求。

在功能设计上,该模型也针对性解决了此前的生成短板:场景扩展功能支持用户基于已有视频的结尾无缝续接内容,单次扩展步长为10秒,累计最长生成时长可达40秒,能够满足短剧、商业广告等短内容的完整制作需求;运镜控制功能支持用户指定镜头的起始帧与结束帧,即可生成平滑自然的专业级运镜与转场效果,省去大量后期调整成本;此外模型还支持最长3秒的参考视频片段导入,能够在生成新内容时精准维持原有场景的背景风格、角色特征的一致性,大幅降低生成内容的崩坏概率。

为了适配不同用户的需求,该模型还提供了多档分辨率选项,用户可根据自身对画质和生成速度的要求灵活选择,实现效果与效率的平衡。

作为谷歌面向开发者和专业创作者群体推出的高性能工具,Gemini Omni 1.1 Flash的落地也标志着视频生成AI正式进入商用成熟阶段。

后续随着该模型的API对外开放,其能力将快速接入各类内容创作工具、短视频平台、影视后期生产链路中,直接降低专业级短内容的制作成本与周期。而谷歌此次的技术迭代,也将进一步倒逼行业内其他厂商加快视频生成赛道的技术研发,推动整个多模态内容生产产业向更长时、更高清、更可控的方向快速演进。

本文基于公开信息分析整理,仅供参考。更多AI工具动态与行业解读,请持续关注本站更新。