苹果发布LiTo 3D生成大模型 单图可生成高保真光影3D对象

2026年3月18日,苹果AI研究团队正式推出名为LiTo(表面光场标记化)的3D生成大模型,该模型凭借首创的潜在空间统一3D表示法,可仅凭单张平面图像生成高保真3D对象,光影还原度较同类技术提升37%,解决了传统3D重建朝向偏差、多视角光影不一致等行业长期痛点。

单张照片就能生成和实物一模一样、光影效果完全匹配的3D模型?过去只存在于科幻场景里的能力,正在被苹果的AI团队变成现实。在3D生成赛道,此前主流方案普遍存在依赖多视角输入、几何结构变形、跨视角光影穿帮等问题,落地门槛始终居高不下,苹果LiTo模型的推出,直接击中了行业的核心痛点。

LiTo的核心竞争力来自首创的统一3D潜在表示法,这套架构创新性地将复杂的表面光场数据压缩为紧凑向量集,通过数学建模直接掌握物体几何形状与光线交互的物理规律,不需要依赖海量多视角样本的暴力拟合,单张图像生成3D模型仅需不到1秒。其采用的编码器-解码器双向机制中,编码器负责提取输入图像的几何结构与外观特征,解码器则可以精准复现镜面高光、菲涅尔反射等普通3D模型很难实现的高级视觉效果。

为训练LiTo,苹果研究团队使用了包含数千个不同材质、形态对象的3D数据集,实验结果显示,该模型不仅严格遵循摄像机坐标系,彻底解决了同类模型常见的物体朝向错误问题,在多视角光影一致性核心指标上,光影还原度较同类方案提升37%,生成的3D对象从任意角度观察都不会出现光影穿帮问题。

LiTo的推出并非孤立的技术研究,而是苹果布局空间计算生态的关键一步。随着Vision Pro等头显设备的普及,消费级市场对3D内容的需求正在爆发,但传统3D建模流程需要专业操作人员使用多台设备拍摄采集,单款普通商品的3D模型制作成本动辄数千元、耗时3-5天,远远无法满足市场需求。

如果LiTo后续实现商业化落地,普通用户仅需用手机拍摄一张照片,就能在几秒内生成符合专业标准的3D模型,不管是Vision Pro用户随手将现实物体导入虚拟空间,还是电商平台批量制作3D商品展示素材,甚至是数字孪生场景的快速建模,成本都将降至原来的百分之一级别。

从目前披露的技术参数来看,LiTo已经具备了消费级落地的基础性能,但距离正式进入产品端还有部分优化空间,比如针对透明、高反光等特殊材质物体的重建精度,以及复杂背景下的物体分割能力,都是苹果团队后续需要攻克的问题。

按照苹果的技术落地惯例,这类底层AI技术通常会首先面向开发者开放API,之后逐步整合进iOS、visionOS等系统的原生功能中,未来2-3年内,普通用户很可能就能在iPhone相册里体验到单图转3D的功能。

本文基于公开信息分析整理,仅供参考。更多AI工具动态与行业解读,请持续关注本站更新。