AI 问小创

你好,我是问小创 AI 助手

告诉我你的需求,我帮你从站内挑最合适的 AI 工具。

推荐结果基于站内收录,仅供参考,请以实际工具信息为准。
猜你想问
推荐一些AI写作工具 有什么AI绘画工具? 推荐视频剪辑AI工具
AI
问小创: 告诉我你的需求,我帮你从站内挑最合适的 AI 工具。

商汤开源SenseNova轻量级多模态模型 支持原生4K图像生成

2026年8月3日,商汤科技正式开源轻量级统一多模态模型预览版SenseNova U1.5-Lite-Preview。该模型基于自研NEO-unify架构打造,仅搭载8B-MoT参数,即可实现原生4K图像生成、精准中英文字生成、稳定图像编辑等能力,大幅提升复杂多模态指令理解精度,进一步降低多模态AI技术的落地门槛。

当前多模态AI生成赛道的竞争正逐渐从“堆参数提能力”转向“降本增效落地”,高分辨率生成、精准指令理解等此前仅属于大参数模型的能力,正在向轻量级模型下沉。商汤此次发布的开源模型,正是这一趋势下的代表性产物。

作为SenseNova U1的系统性迭代版本,SenseNova U1.5-Lite-Preview依托NEO-unify架构的优化,在仅8B-MoT参数规模下就实现了此前大模型才具备的原生4K分辨率图像生成能力,生成内容的纹理精细度、中英文字符准确率均较上一代有明显提升。

不同于多数小参数模型需要通过超分算法间接实现高清输出,该模型的原生4K能力避免了多次运算带来的细节损耗,同时大幅缩短了高清内容的生成耗时。此外,模型针对长篇自然语言描述、结构化视觉指令的理解能力做了专项优化,即便是包含多层逻辑的复杂创作需求,也能实现更精准的视觉控制。

此次升级的另一大核心亮点是图像编辑能力的完善。新模型支持参考图风格迁移、多参考图组合编辑以及交互式精准调整,打破了此前AI图像生成“一次性输出、难以微调”的局限,让AI图像创作从单次生成转向可迭代的持续优化流程。

对于设计师、内容创作者等专业用户而言,这一能力可以大幅提升创作效率:用户可以先生成基础草图,再通过多次指令调整局部元素、风格调性,无需每次重新输入完整提示词,也能得到符合预期的成品。

商汤方面表示,此次开源该模型的核心目的是让更多中小开发者、企业用户能以更低的算力成本用上高性能多模态能力。目前该模型已经可以在消费级显卡上流畅运行,无需依赖昂贵的云端算力集群。

业内分析认为,这类轻量级高性能多模态模型的普及,将推动多模态AI在电商美工、教育内容生成、数字营销等多个下沉场景的落地,进一步拓展AI生成内容的应用边界。

本文基于公开信息分析整理,仅供参考。更多AI工具动态与行业解读,请持续关注本站更新。