CONSONANCE.for your information
Thứ Hai, 5 tháng 10, 2026frenvi

Đáng đọc kỹ

01 — agents 20 upvote

Agent-Editing World Model: Rethinking World Modeling for LLM Agents

CÂU HỎI — Làm thế nào để cải thiện LLM agents bằng cách mô hình hóa tiến trình nhiệm vụ và chỉnh sửa trạng thái reasoning thay vì chỉ dự đoán phản hồi từ tool?

Các tác giả đề xuất Agent-Editing World Model (AEWM), một framework tập trung mô hình hóa cách lập luận và hành động định hình tiến trình nhiệm vụ thay vì giả lập phản hồi của tool vốn có độ entropy cao. Hệ thống kết hợp Action Judge để phân loại quyết định thành Critical, Exploratory, và Noisy cùng với State Revision để sửa đổi các chuỗi reasoning-action bị nhiễu. Thêm vào đó, EditAct tích hợp khả năng này với việc thực thi thực tế nhằm thay đổi trực tiếp trạng thái nền tảng cho các quyết định tiếp theo. Qua huấn luyện trên Search, Terminal và Software Engineering, AEWM đạt 70.5% macro-F1 trên Action Judge benchmark và cải thiện độ chính xác trên nhiều benchmarks.

AEWM đạt 70.5% macro-F1 trên Action Judge benchmark, vượt baseline mạnh nhất 10.6 điểm.

EditAct cải thiện điểm số trung bình từ 3.2--6.7 điểm qua sáu benchmarks và ba agent backbones so với baseline mạnh nhất.

AEWM-RFT cải thiện hơn Self-RFT từ 2.2--2.6 điểm qua ba domain mà không cần online AEWM guidance.

SNHE · 23 thg 9, 2026 đọc bản gốc ↗
↑