CONSONANCE.for your information
Thứ Hai, 5 tháng 10, 2026frenvi

Đáng đọc kỹ

01 — architecture 77 upvote

Your Transformer Can Hold Two Thoughts at Once: Evidence of Linear Superposition in LLMs

CÂU HỎI — Large Language Models thể hiện tính tuyến tính trong superposition như thế nào khi các input stream khác nhau được kết hợp tuyến tính?

Nghiên cứu chứng minh rằng LLM biểu hiện tính tuyến tính nền tảng: khi các input từ các dòng văn bản riêng biệt được kết hợp tuyến tính, model sẽ output superposition của các phân phối next-token riêng lẻ. Hiện tượng này giảm dần trong quá trình pretraining nhưng có thể được khôi phục thông qua lightweight fine-tuning. Thêm vào đó, nhóm tác giả giới thiệu một quy trình guided decoding giúp tách rời các output bị chồng chéo, cho phép generate đồng thời hai continuation mạch lạc chỉ từ một forward pass duy nhất.

Các LLM xuất hiện hiện tượng Superposition Linearity Hypothesis khi kết hợp tuyến tính input stream.

Tính tuyến tính có thể được khôi phục đáng kể thông qua lightweight fine-tuning.

Quy trình guided decoding cho phép generate đồng thời hai continuation mạch lạc từ một forward pass.

razzant · 24 thg 9, 2026 đọc bản gốc ↗
↑