SpeakerMem-R1: Speaker-Centered Dual-Track Memory for Multi-Party Dialogue
Nghiên cứu này giải quyết các điểm nghẽn về quy kết thông tin và hiểu quan hệ trong hội thoại nhiều người bằng cách đề xuất SpeakerMem-R1, một hệ thống bộ nhớ kênh đôi lưu trữ các thông điệp nguyên văn có gán nhãn người nói và các trạng thái suy ra theo góc nhìn cá nhân và nhóm. Để giảm lỗi quy kết và cập nhật, họ huấn luyện Writer-R1 sử dụng SpeakerLevenshtein và speaker-conditioned GRPO. Kết quả cho thấy mô hình đạt độ chính xác nhị phân lần lượt là 47,9%, 69,2% và 61,9% trên GroupMemBench, SocialMemBench và EverMemBench, đồng thời đạt 62,33% trên bảng xếp hạng EverMemBench và 70,85% trên các câu hỏi LoCoMo.
SpeakerMem-R1 đạt độ chính xác nhị phân lần lượt là 47,9%, 69,2% và 61,9% trên GroupMemBench, SocialMemBench và EverMemBench.
Đạt kết quả 62,33% trên bảng xếp hạng EverMemBench công khai từ EverMind-AI.
Thu được tỷ lệ chính xác 70,85% trên toàn bộ 1.986 câu hỏi LoCoMo.