EvolveTrade: Experience-Driven Policy Refinement for Self-Evolving LLM Trading Agents
Tác giả đề xuất EvolveTrade, một framework tự tiến hóa dành cho các LLM trading agent, xử lý system prompt của agent như một chính sách tham số hóa bằng văn bản. Sau mỗi khoảng thời gian cập nhật, một Policy Agent sẽ chỉnh sửa chính sách này dựa trên các vết quyết định (decision traces) tích lũy và phản hồi danh mục đầu tư thực tế, trong khi giữ nguyên mô hình LLM nền tảng. Thử nghiệm trên nhiều chế độ thị trường khác nhau cho thấy phương pháp này giúp cải thiện tỷ lệ Sharpe và lợi nhuận tích lũy so với các baseline sử dụng chính sách tĩnh.
EvolveTrade cải thiện Tỷ lệ Sharpe (Sharpe Ratio) và Lợi nhuận tích lũy (Cumulative Return) so với các baseline LLM sử dụng chính sách tĩnh trong hầu hết các thiết lập đánh giá.
Chính sách tự tiến hóa làm tăng lượng phân tích qua mã nguồn và kích hoạt các tính toán phù hợp với trạng thái thị trường.
Khung hệ thống giữ nguyên mô hình LLM nền tảng trong suốt quá trình cập nhật system prompt dạng văn bản.