CONSONANCE.for your information
Thứ Hai, 5 tháng 10, 2026frenvi

Đáng đọc kỹ

01 — agents 17 upvote

RoboFoundry: System-as-Policy Evolution for Self-Learning Embodied Agents

CÂU HỎI — Làm thế nào để chuyển đổi trải nghiệm thực thi của các tác nhân thể hiện thành các cập nhật hệ thống liên tục và tự cải thiện?

Bài báo đề xuất RoboFoundry, một framework tác nhân thể hiện định nghĩa quá trình tiến hóa dưới dạng Self-Evolving System-as-Policy. Hệ thống này chẩn đoán các khoảng trống năng lực, chuyển đổi dấu vết thực thi thành các cập nhật hệ thống được xác thực trên hệ thống ngữ cảnh và hệ thống kỹ năng phân cấp. Kết quả thử nghiệm trên EmbodiedBench cho thấy RoboFoundry cải thiện GPT-5.5 thêm 27.8%, đưa Qwen3.7-Plus đạt gần mức tương đương 70.3% so với 72.7%, đồng thời vượt trội trên các benchmark RoboMemArena và LIBERO-PRO.

On EmbodiedBench, RoboFoundry achieves state-of-the-art performance, notably improving GPT-5.5 by 27.8%.

It also brings Qwen3.7-Plus to near parity with GPT-5.5 (70.3% vs. 72.7%), showing consistent gains from system-as-policy evolution across foundation models.

For long-horizon memory, RoboFoundry outperforms all baselines on RoboMemArena by at least 39.0%, even against methods assisted by external foundation models.

EthanTaylor · 26 thg 9, 2026 đọc bản gốc ↗
↑