问小创
告诉我你的需求,我帮你从站内挑最合适的 AI 工具。
网站截图
Gemini Omni是谷歌推出的多模态AIGC工具,核心定位是“从任意输入创造任何内容”,主打以视频创作为核心入口,打通了Gemini的推理能力与生成创作能力。区别于普通单模态生成工具,它可同时兼容文本、图像、视频、音频等多类型输入素材,还融合了世界知识、物理规则逻辑,生成的内容自带SynthID和C2PA版权溯源标识,既保障创作自由度,也解决了AIGC内容的版权合规问题,适配短视频制作、新媒体内容产出、创意内容demo制作等多类场景,能够大幅降低多模态内容的生产门槛。
Gemini Omni可实现从文本prompt直接生成符合物理逻辑的高清短视频,也支持上传参考图生成同风格的动态视频,还可对已有视频进行对话式编辑,比如输入“把视频中的背景换成海边,给人物添加遮阳帽”即可快速输出修改后的成品。生成的视频流畅度高,场景符合常识认知,不会出现结构崩坏问题,同时自带的溯源标识可直接用于商用发布,无需额外做版权认证。
首先多模态支持能力强,区别于普通AI视频生成工具仅支持单一输入,Gemini Omni可同时融合文本、图像、音视频等多类参考素材,生成内容更贴合用户需求;其次生成内容符合物理逻辑,融合了Gemini的推理能力,不会出现常规AI生成视频中常见的结构崩坏、常识错误问题;第三自带版权溯源标识,所有生成内容自带SynthID和C2PA标识,解决了AIGC内容商用的版权合规痛点;第四操作门槛低,对话式编辑无需专业剪辑技能,普通用户也可快速上手。
我们这次实测用Gemini Omni做了一条美食探店类的短视频,只输入了“生成一条15秒的夏日冰粉探店短视频,风格清新活泼,适配小红书发布”的指令,不到1分钟就生成了符合要求的成品,画面流畅没有逻辑错误,效果超出预期。整体感觉操作门槛非常低,完全不需要剪辑基础就能用,生成的内容自带溯源标识也不用担心版权问题。比较建议内容创作者、新媒体运营人员入手,能省不少制作时间,唯一的小问题是目前国内访问需要额外的网络环境。