Luce是苹果研究团队提出的一种新型3D表示方法,旨在解决单图像到3D生成中的几何与材质重建问题。该方法将几何和基于物理的渲染(PBR)材质统一到体素化的多模态高斯云中,每种模态使用专用高斯原语,并通过变分自编码器压缩为材质感知的潜在空间。一个基于修正流变换器的生成模型从单张图像生成该潜在表示,并利用预训练图像编码器的多层特征以保留语义和空间细节。在Toys4K基准上,Luce实现了最先进的单图像到3D生成性能,FID较最强基线提升28%;在AI生成图像基准上,CLIP图像对齐得分达0.8519,优于基线0.8299。该方法生成的资产支持重照明,几何准确且材质保真,能保留文字、标志等精细细节,适用于标准渲染管线。
📱 每天一份 AI 前沿日报
关注公众号,每天 09:00 推送 · 不错过任何重磅