CONSONANCE.for your information
Thứ Hai, 5 tháng 10, 2026frenvi

Đáng đọc kỹ

01 — training 70 upvote

FuseReg: Regularizing Layer Fusion Mitigates the Reconstruction-Generation Gap in Representation Autoencoders

CÂU HỎI — Làm thế nào để giảm khoảng cách giữa khả năng tái tạo và khả năng sinh ảnh trong các representation autoencoders (RAEs) mà không cần chỉnh sửa encoder được huấn luyện trước?

Các tác giả giới thiệu FuseReg, một phương pháp chuẩn hóa thay thế việc chọn lựa tầng cố định bằng việc huấn luyện trên các tập con ngẫu nhiên của các tầng encoder. Bằng cách phạt độ nhạy cảm với sự bất đồng giữa các tầng, phương pháp này tạo ra một decoder duy nhất có thể tái tạo từ nhiều kiểu tích hợp tầng khác nhau mà không cần huấn luyện lại. Kết quả thực nghiệm trên ImageNet-256 cho thấy việc thay thế decoder giúp giảm gFID không hướng dẫn 27%, trong khi chuẩn hóa kết hợp trong huấn luyện diffusion giúp giảm gFID không hướng dẫn 29%.

Decoder replacement alone reduces unguided gFID by 27% with an unchanged RAEv2 DiT-XL generator.

Joint regularization of both stages reduces unguided gFID by 29% on DiT-Base.

Hongyang-Du · 25 thg 9, 2026 đọc bản gốc ↗
↑