CONSONANCE.for your information
lundi 5 octobre 2026frenvi

À lire de près

01 — multimodal 77 votes

World Observer: Joint Actor-Observer Generation for Persistent World Modeling

QUESTION — Comment les modèles du monde vidéo peuvent-ils simuler en continu des régions situées en dehors du champ de vision actuel d'un agent ?

L'article présente World Observer, une méthode qui dissocie l'observation de l'action pour résoudre la limite selon laquelle les modèles du monde vidéo perdent la trace des objets quittant la vue d'un agent. Le système génère conjointement une vue d'acteur en perspective pour les tâches centrées sur l'agent avec un ou plusieurs observateurs panoramiques surveillant des régions sélectionnées. En utilisant une source panoramique partagée et un Observer Sink pour restaurer les références haute résolution lors du retour, la méthode permet aux objets hors champ de continuer à évoluer visuellement.

World Observer dissocie l'observation de l'action en générant conjointement une vue d'acteur en perspective avec des observateurs panoramiques.

La méthode utilise un Observer Sink de références en perspective haute résolution pour restaurer l'apparence fine lors du retour dans le champ.

World Observer améliore considérablement la dynamique hors champ tout en restant compétitif en matière de fidélité visuelle et de contrôle de la caméra.

enrue1893 · 01 oct. 2026 lire l'original ↗
↑