01 · agents
RSIAgent: Autonomous Exploration for Recursive Self-improvement in New Environments
Câu hỏiLàm thế nào các agent số có thể tự cải thiện đệ quy trong các môi trường mới chưa từng thấy mà không cần cập nhật tham số mô hình?
Nhóm tác giả giới thiệu RSIAgent, một framework đa agent không cần huấn luyện (training-free) để tự cải thiện đệ quy thông qua việc xây dựng bộ nhớ tự động. RSIAgent phối hợp các agent lập lịch, tác nhân và thẩm định để khám phá môi trường liên tục, xác thực kết quả và lưu giữ kiến thức đặc thù, bao gồm mối quan hệ nhân quả tái sử dụng được. Framework áp dụng chiến lược khám phá rộng rồi sâu để tìm cấu trúc môi trường và các ca khó. Bộ nhớ thu được bị đóng băng và tái sử dụng trực tiếp cho các tác vụ hạ nguồn. Kết quả trên OSWorld-v2 và Agent's Last Exam cho thấy RSIAgent giúp các mô hình nguồn mở như Kimi-K3 và GLM-5.3 vượt qua các mô hình nguồn đóng hàng đầu như GPT-6.
RSIAgent là một framework đa agent không cần huấn luyện cho phép tự cải thiện đệ quy thông qua xây dựng bộ nhớ tự động.
Chiến lược khám phá rộng rồi sâu kết hợp khám phá song song để tìm cấu trúc môi trường và khai thác các ca khó.
Thực nghiệm trên OSWorld-v2 và Agent's Last Exam cho thấy Kimi-K3 và GLM-5.3 vượt qua các mô hình nguồn đóng hàng đầu bao gồm GPT-6.