CONSONANCE.for your information
lundi 5 octobre 2026frenvi

À lire de près

01 — agents 26 votes

EmbodiedMemory-Bench: Benchmarking Embodied Memory for Long-Horizon Embodied Tasks

QUESTION — Comment évaluer et améliorer systématiquement les capacités de mémoire incarnée à long horizon dans des environnements interactifs ?

L'article identifie les lacunes fondamentales de la mémoire des agents incarnés et présente EmbodiedMemory-Bench (EMem-Bench), comprenant 2 554 épisodes interactifs pour évaluer ces capacités. Pour y remédier, les auteurs présentent Embodied-Memorizer (EMem), un système de mémoire externe organisant les expériences en mémoires spatiales, d'événements et de scènes, ainsi qu'un modèle de politique 8B (EMem-8B). Les résultats montrent qu'EMem améliore les performances de divers modèles multimodaux open-source et propriétaires.

EMem-Bench comprises 2,554 interactive episodes across four task families.

Under matched backbones, EMem achieves the best overall performance among the evaluated memory systems and improves both open-source and proprietary models, while EMem-8B further improves over its backbone.

lzLiang · 23 sept. 2026 lire l'original ↗
↑