huggingface.co détecté sur le web

Lucida décompose la modélisation 3D indoor en 'parse-generate-place' et gagne 69 % de mAP sur R2S-Scene

Robotics Computer Vision 3d-scene robotics

Résumé

Lucida, papier arXiv publié le 31 août, transforme des vidéos de scènes intérieures encombrées en répliques 3D éditables et prêtes pour la simulation via un pipeline 'parse-generate-place' avec la VLM GizmoAct pilotant les placements. Résultats : +69 % de mAP sur R2S-Scene vs Boxer, [email protected] passant de 57,8 % à 83,4 % sur CA-1M, et Scene F-Score porté de 0,794 à 0,924 face à SAM3D.