问小创
告诉我你的需求,我帮你从站内挑最合适的 AI 工具。
2026年6月22日,阿里巴巴正式发布视频生成模型HappyHorse1.1,相较此前的1.0版本,该模型在动态表现力、主体一致性、指令遵循、视觉质感、音频能力五大核心维度实现系统性升级,综合性能提升显著,目前已接入三大官方平台,面向开发者、创作者及企业用户开放使用,进一步巩固了其在国内AI视频生成赛道的竞争力。

近一年来,文生视频赛道的技术迭代速度远超行业预期,从10秒以内的短时长demo输出,到可支持分钟级商用内容生成,各厂商的技术比拼已经从“能不能生成”转向“好不好用”。
用户对视频流畅度、主体一致性、声画匹配度的要求不断拉高,此前多个版本的文生视频模型普遍存在的人物穿模、动作卡顿、指令理解偏差等问题,已经成为阻碍技术大规模商用的核心痛点,也倒逼头部玩家加快版本迭代节奏。
随着AIGC内容的商业化需求爆发,短视频创作、电商营销、影视制作等领域对AI生成视频的实用性要求持续提升。此前行业内的多数开源及商用模型,仅能满足基础的创意演示需求,一旦涉及多主体、长时长、精细化场景的生成需求,出错率会大幅升高,无法落地到实际生产环节。
在此背景下,头部科技企业的迭代方向普遍转向“可用性优先”,针对实际生产场景的痛点做定向技术优化,本次阿里推出的HappyHorse1.1正是这一趋势下的代表性产物。
作为阿里旗下视频生成大模型的核心迭代版本,HappyHorse1.1针对此前1.0版本暴露的短板,完成了全链路的技术优化。
其中动态表现力层面,模型优化了时序建模逻辑,生成视频的帧间过渡更自然,人物连续动作的生硬感大幅降低,15秒以上长视频的流畅度提升超过40%;主体一致性方面,多帧画面中核心人物、物体的属性偏移率下降近70%,基本不会出现服饰、外形中途突变的穿模问题。
除此之外,模型的指令遵循率提升了35%,可精准识别包含多场景、多主体的复杂用户指令;视觉质感升级后,画面分辨率最高支持4K输出,光影、纹理的真实感明显增强;新增的音频生成能力可实现声画同步输出,音画延迟低于0.1秒,无需后期二次配音即可直接使用。
目前,HappyHorse1.1已经全面接入HappyHorse官网、阿里云百炼、千问云三大平台,普通创作者可直接在线调用生成内容,开发者也可通过API接口接入自有产品做二次开发。
此次升级之后,HappyHorse系列模型的商用适配性大幅提升,可覆盖短视频内容创作、电商商品展示、企业营销物料生产、影视动画预演等多个场景。
据阿里相关技术负责人透露,目前已有不少电商商家开始测试用该模型生成商品展示视频,相较传统实景拍摄,制作周期可缩短90%,成本降低超过80%。后续阿里还将针对不同行业的具体需求开放定制化训练能力,进一步降低AI视频生成技术的使用门槛,推动全行业的内容生产效率提升。
本文基于公开信息分析整理,仅供参考。更多AI工具动态与行业解读,请持续关注本站更新。