AI 问小创

你好,我是问小创 AI 助手

告诉我你的需求,我帮你从站内挑最合适的 AI 工具。

推荐结果基于站内收录,仅供参考,请以实际工具信息为准。
猜你想问
推荐一些AI写作工具 有什么AI绘画工具? 推荐视频剪辑AI工具
AI
问小创: 告诉我你的需求,我帮你从站内挑最合适的 AI 工具。

商汤开源轻量多模态模型U1.5-Lite:8B参数覆盖4K全视觉能力

2026年8月4日,商汤科技正式面向全球开发者社区开源轻量统一多模态模型SenseNova U1.5-Lite-Preview。该模型基于前代SenseNova U1系统性迭代,单一架构融合视觉理解、推理、生成、编辑四大核心能力,仅以8B-MoE参数规模即支持原生4K分辨率输出、真实质感生成与复杂视觉控制,为多模态模型轻量化落地提供了新的技术路径。

在行业普遍通过堆高参数规模实现多模态能力升级的当下,商汤这次推出的开源模型走出了一条完全不同的路线:其参数规模仅为同类4K能力模型的1/4不到,推理算力需求降幅超过60%,直接降低了高规格多模态能力的使用门槛。

当前多模态模型的落地正陷入“能力-成本”的两难困境:要实现4K生成、复杂图像编辑等高阶视觉能力,往往需要30B以上参数的大模型支撑,单卡推理成本居高不下,中小团队甚至普通开发者根本难以负担;而小参数多模态模型大多只支持1080P及以下分辨率,图像质感、指令遵循能力普遍不足,无法满足商用场景需求。

统一多模态架构的出现,原本就是为了打通不同视觉能力的技术栈,降低模型迭代的边际成本,但此前的验证模型参数规模仍然偏高,距离普惠落地还有不小的距离。

此次发布的SenseNova U1.5-Lite-Preview,正是商汤在统一多模态路线上的第二次重要落地。2025年推出的SenseNova U1已经验证了单一架构覆盖多类视觉能力的可行性,而U1.5则实现了能力和轻量化的平衡突破。

仅8B-MoE的参数规模下,该模型实现了四大核心能力升级:一是原生支持4K分辨率图像生成,无需额外的超分模块即可输出无畸变的高清内容;二是局部纹理和真实世界质感的还原度大幅提升,金属、玻璃、织物等材质的光影表现接近实拍效果;三是中英文文字生成准确率提升40%,支持海报、宣传单页等复杂版式的自动组织;四是图像编辑的指令遵循稳定性提升35%,局部修改、风格转换等操作的一致性更有保障。

商汤技术团队透露,为了解决小参数模型高分辨率生成常见的网格伪影、细节模糊问题,团队对模型的视觉注意力机制做了针对性优化,在减少算力消耗的同时,强化了对局部像素的关联建模能力。

本次开源面向所有非商用场景开放,开发者可以直接基于该模型二次开发,适配图像生成、创意设计、工业质检、智能终端等多个场景的需求。

在商汤的规划中,U1.5系列后续还将推出更小参数的端侧版本,以及面向商用场景的增强版,进一步拉低统一多模态能力的落地门槛。随着越来越多轻量化、高能力的多模态模型进入开源社区,过去只有头部企业才能用上的高阶AI视觉能力,未来有望进入千行百业的日常应用中。

本文基于公开信息分析整理,仅供参考。更多AI工具动态与行业解读,请持续关注本站更新。