CONSONANCE.for your information
Thứ Hai, 5 tháng 10, 2026frenvi

Đáng đọc kỹ

01 — agents 12 upvote

Systematically Exploring the Capabilities of GPT-6 Astra as Embodied Policies

CÂU HỎI — GPT-6 Astra thể hiện năng lực và hạn chế như thế nào khi đóng vai trò là chính sách hiện thân (embodied policies) trực tiếp điều khiển robot qua các tác vụ khác nhau?

Nghiên cứu đánh giá toàn diện GPT-6 Astra trong vai trò chính sách robot tổng quát qua sáu lĩnh vực, bao gồm điều khiển trực tiếp, hợp tác với các chính sách đã học và thích ứng dựa trên phản hồi. Kết quả cho thấy mô hình có khả năng lập kế hoạch và sinh hành động số nhưng gặp khoảng cách lớn giữa việc ra quyết định hữu ích và điều khiển vật lý đáng tin cậy. Độ trễ suy luận là một điểm nghẽn lớn: trong các thử nghiệm RoboDojo, việc điều khiển tiêu tốn từ 624,8 triệu đến 1,132 tỷ token. Một lần chạy vận động kéo dài 30 giây đòi hỏi 250 lần gọi mô hình với trung bình 39,86 giây cho mỗi lần gọi khi vật lý bị tạm dừng.

Hybrid control với π0.5 đạt 48% success trên RoboDojo subset.

Trong navigation, Astra đạt 92% success trên RxR instruction following và 82% trên HM3D object search.

Một 30-second locomotion run yêu cầu 250 model calls averaging 39.86 seconds each.

qizekun · 29 thg 9, 2026 đọc bản gốc ↗
↑