Capable yet Parsimonious: Extracting and Characterizing Hidden Chain-of-Thought in Frontier Models
CÂU HỎI — Làm thế nào để trích xuất và phân tích chuỗi suy luận ẩn (hidden CoT) từ các mô hình ngôn ngữ lớn đóng kín thông qua API tiêu chuẩn?
Nghiên cứu này khai thác một custom tool đơn giản đăng ký qua API tiêu chuẩn để ép các mô hình biên (frontier models) ngoại hóa quá trình suy luận trung gian vốn bị ẩn trong các hệ thống đóng. Bằng cách so sánh với native CoT trên các mô hình mở và mở rộng sang các hệ thống như GPT-6 Astra, các tác giả chứng minh rằng chuỗi suy luận được trích xuất đạt hiệu suất tương đương native CoT và vượt trội hơn hẳn các baseline không có suy luận trong các bài toán toán học cạnh tranh, khoa học và sinh mã. Phân tích cấu trúc cho thấy các mô hình như Astra thể hiện khả năng hướng dẫn suy luận hiệu quả về token, xử lý các bước sơ cấp bên trong và chỉ ngoại hóa các phần cốt lõi.
Xiaoyuluoit97 · 22 thg 9, 2026
đọc bản gốc ↗