CONSONANCE.for your information
Thứ Hai, 5 tháng 10, 2026frenvi

Đáng đọc kỹ

01 — agents 38 upvote

EvolveTrade: Experience-Driven Policy Refinement for Self-Evolving LLM Trading Agents

CÂU HỎI — Làm thế nào để các LLM trading agent có thể tự thích nghi và cải thiện chính sách sử dụng công cụ của chúng theo thời gian mà không cần thay đổi mô hình nền tảng?

Tác giả đề xuất EvolveTrade, một framework tự tiến hóa dành cho các LLM trading agent, xử lý system prompt của agent như một chính sách tham số hóa bằng văn bản. Sau mỗi khoảng thời gian cập nhật, một Policy Agent sẽ chỉnh sửa chính sách này dựa trên các vết quyết định (decision traces) tích lũy và phản hồi danh mục đầu tư thực tế, trong khi giữ nguyên mô hình LLM nền tảng. Thử nghiệm trên nhiều chế độ thị trường khác nhau cho thấy phương pháp này giúp cải thiện tỷ lệ Sharpe và lợi nhuận tích lũy so với các baseline sử dụng chính sách tĩnh.

EvolveTrade cải thiện Tỷ lệ Sharpe (Sharpe Ratio) và Lợi nhuận tích lũy (Cumulative Return) so với các baseline LLM sử dụng chính sách tĩnh trong hầu hết các thiết lập đánh giá.

Chính sách tự tiến hóa làm tăng lượng phân tích qua mã nguồn và kích hoạt các tính toán phù hợp với trạng thái thị trường.

Khung hệ thống giữ nguyên mô hình LLM nền tảng trong suốt quá trình cập nhật system prompt dạng văn bản.

YuminChoi · 15 thg 9, 2026 đọc bản gốc ↗
↑