杂乱场景一键生成可编辑仿真环境
推荐指数 63.0 NO. 025 · 2026.09.02
upvotes66comments1
为什么值得看
Lucida 将室内场景重建拆分为解析、资产生成和 VLM 引导放置三个模块,从杂乱的真实扫描中生成可单独操作的仿真就绪场景。对机器人仿真和具身 AI 团队来说,这意味着不再需要人工清理扫描数据或逐个建模物体。
媒体预览
编辑判断
之前做 real-to-sim 的团队大多用 Habitat、iGibson 自带的手动整理场景,或者靠人工在 Blender 里清理扫描 mesh,流程很重。Lucida 的 trick 是把"放置"这一步交给 VLM 做语义约束的空间推理,而不是传统的手工标定或纯几何对齐,这在 cluttered capture 场景下容错率高很多。
不过论文没提推理时延和 GPU 需求,VLM 引导的放置环节如果每次都要调大模型,批量生成场景的性价比会打折扣。做机器人仿真的团队可以先关注他们是否开源 placement 模块的轻量化版本。