问小创
告诉我你的需求,我帮你从站内挑最合适的 AI 工具。
2026年8月3日,商汤科技正式开源轻量级统一多模态模型预览版SenseNova U1.5-Lite-Preview。该模型基于自研NEO-unify架构打造,仅搭载8B-MoT参数,即可实现原生4K图像生成、精准中英文字生成、稳定图像编辑等能力,大幅提升复杂多模态指令理解精度,进一步降低多模态AI技术的落地门槛。
当前多模态AI生成赛道的竞争正逐渐从“堆参数提能力”转向“降本增效落地”,高分辨率生成、精准指令理解等此前仅属于大参数模型的能力,正在向轻量级模型下沉。商汤此次发布的开源模型,正是这一趋势下的代表性产物。
作为SenseNova U1的系统性迭代版本,SenseNova U1.5-Lite-Preview依托NEO-unify架构的优化,在仅8B-MoT参数规模下就实现了此前大模型才具备的原生4K分辨率图像生成能力,生成内容的纹理精细度、中英文字符准确率均较上一代有明显提升。
不同于多数小参数模型需要通过超分算法间接实现高清输出,该模型的原生4K能力避免了多次运算带来的细节损耗,同时大幅缩短了高清内容的生成耗时。此外,模型针对长篇自然语言描述、结构化视觉指令的理解能力做了专项优化,即便是包含多层逻辑的复杂创作需求,也能实现更精准的视觉控制。
此次升级的另一大核心亮点是图像编辑能力的完善。新模型支持参考图风格迁移、多参考图组合编辑以及交互式精准调整,打破了此前AI图像生成“一次性输出、难以微调”的局限,让AI图像创作从单次生成转向可迭代的持续优化流程。
对于设计师、内容创作者等专业用户而言,这一能力可以大幅提升创作效率:用户可以先生成基础草图,再通过多次指令调整局部元素、风格调性,无需每次重新输入完整提示词,也能得到符合预期的成品。
商汤方面表示,此次开源该模型的核心目的是让更多中小开发者、企业用户能以更低的算力成本用上高性能多模态能力。目前该模型已经可以在消费级显卡上流畅运行,无需依赖昂贵的云端算力集群。
业内分析认为,这类轻量级高性能多模态模型的普及,将推动多模态AI在电商美工、教育内容生成、数字营销等多个下沉场景的落地,进一步拓展AI生成内容的应用边界。
AI创作导航,创作与探索并重。聚合全球优质AI工具,覆盖短视频、图文、写作、设计等创作场景,以及办公、学习、编程、生活等全品类需求。从创作出发,探索AI的无限可能,为创作者、学生、教师、职场人提供一站式AI工具导航与场景化应用指南。