Does Learning Protein Folding Generalize to Broader Reasoning?
Tác giả xây dựng FoldingCorpus, một tập dữ liệu hỏi đáp bắt nguồn từ protein, và đề xuất Fold2Reason, một tiến trình hậu huấn luyện sử dụng cả câu trả lời cấu trúc rời rạc và hình học 3D liên tục. Phương pháp này nhằm kiểm tra xem dữ liệu khoa học giàu cấu trúc có thể nâng cao khả năng suy luận trên diện rộng của LLM hay không. Kết quả trên FoldBench cho thấy Fold2Reason đạt điểm dự đoán cấu trúc cao gấp nhiều lần so với Qwen3.5-9B, đồng thời cải thiện độ chính xác trung bình trên 10 benchmark về không gian, đồ thị và khoa học.
Trên FoldBench, Fold2Reason đạt structure prediction scores từ 2.7 đến 3.5 lần so với Qwen3.5-9B.
Phương pháp này nâng macro-average accuracy từ 45.09% lên 48.33% (+3.23 pp) trên 10 benchmarks bao gồm không gian, đồ thị, khoa học và suy luận tổng quát.