Just-in-Time Memory: Learning to Curate Task-Adaptive Memory for LLM Agents
Bài báo đề xuất Just-in-Time Memory (JitMem), một phương pháp lưu trữ giữ lại toàn bộ raw trajectory thay vì cô đọng ngay lúc ghi dữ liệu. Khi có truy vấn hoặc tác vụ mới xuất hiện ở thời điểm đọc, hệ thống sẽ tổng hợp một payload thích ứng với tác vụ cụ thể đó. Cách tiếp cận này giúp khắc phục bài toán credit-assignment dài hạn và cho phép huấn luyện curator trực tiếp dựa trên thành công của tác vụ tức thì. Thử nghiệm trên ALFWorld, WebShop và τ^2-bench cho thấy JitMem vượt trội hơn hẳn các phương pháp lưu trữ truyền thống.
Trên ALFWorld, WebShop và τ^2-bench, JitMem cải thiện điểm số success-rate so với baseline mạnh nhất lần lượt là 16.2, 16.3 và 3.9 điểm tuyệt đối.
Ngay cả một curator chưa qua huấn luyện cũng đã cạnh tranh hoặc vượt qua các baseline này, cho thấy việc curation thích ứng theo thời điểm đọc là nguồn gốc chính của hiệu năng cải thiện.