Geometric and Semantic Coupling for Interaction Understanding in 3D Scenes
QUESTION — Comment améliorer la compréhension des interactions dans des scènes 3D en couplant des informations géométriques et sémantiques ?
Le travail présente Segment-Snap, qui relie les parties mobiles et les poignées dans des scènes 3D grâce à leur relation physique. Des prédicteurs identifient les surfaces de pièces et les petites poignées, tandis qu'un décodeur géométrique utilise des a priori planaires et verticaux pour contraindre le mouvement. Sur la validation Articulate3D, le guidage par poignée élève l'AP filtré par mouvement de 13,74% à 40,98% à masques et axes fixes.
Le guidage par poignée élève l'AP filtré par mouvement de 13,74% à 40,98% à masques et axes fixes.
Des candidats poignées supplémentaires augmentent l'AP de poignée de 24,63% à 29,65%.
La correction de classe basée sur les pièces ajoute 0,98 points.
imsuperkong · 21 sept. 2026
lire l'original ↗