SpeakerMem-R1: Speaker-Centered Dual-Track Memory for Multi-Party Dialogue
Cette recherche résout les problèmes d'attribution des messages et de compréhension relationnelle dans les dialogues multi-partis en proposant SpeakerMem-R1, un système de mémoire à double piste stockant des messages textuels étiquetés par les locuteurs et des états dérivés organisés en vues au niveau des personnes et des groupes. Pour réduire les erreurs d'attribution et de mise à jour, ils entraînent Writer-R1 en utilisant SpeakerLevenshtein et le GRPO conditionné par les locuteurs. Les résultats montrent des précisions binaires de 47,9%, 69,2% et 61,9% sur GroupMemBench, SocialMemBench et EverMemBench respectivement, ainsi que 62,33% sur le classement EverMemBench et 70,85% sur les questions LoCoMo.
SpeakerMem-R1 atteint des précisions binaires de 47,9%, 69,2% et 61,9% sur GroupMemBench, SocialMemBench et EverMemBench, respectivement.
Atteint 62,33% sur le classement EverMemBench publiquement rapporté d'EverMind-AI.
Il atteint également 70,85% sur l'ensemble des 1 986 questions LoCoMo, que nous utilisons comme test de limite de conversation à long terme à deux personnes.