跳到正文
原文
HuggingFace Daily Papers(社区热门论文)·· 2026-08-31AI 评分45

Lucida:面向可组合真实到仿真场景建模的解析、生成与放置框架

Lucida: Parse, Generate, and Place for Composable Real-to-Sim Scene Modeling

AI 导读

Lucida 提出可组合真实到仿真场景建模方法,将真实室内场景恢复为按观测排布、可单独操作的完整可编辑物体资产。方法沿用解析、生成、放置三步,但把精度要求重新分配到流水线末端:解析视频生成携带逐实例多视角证据的场景图,据此生成完整资产,并用 VLM 策略 GizmoAct 将放置建模为多轮 GUI 交互,闭环操纵物体 gizmo 并自行判断对齐完成。

整理与数据来源:AIHOT

来源:HuggingFace Daily Papers(社区热门论文) · arxiv.org