Systematically Exploring the Capabilities of GPT-6 Astra as Embodied Policies
Nghiên cứu đánh giá toàn diện GPT-6 Astra trong vai trò chính sách robot tổng quát qua sáu lĩnh vực, bao gồm điều khiển trực tiếp, hợp tác với các chính sách đã học và thích ứng dựa trên phản hồi. Kết quả cho thấy mô hình có khả năng lập kế hoạch và sinh hành động số nhưng gặp khoảng cách lớn giữa việc ra quyết định hữu ích và điều khiển vật lý đáng tin cậy. Độ trễ suy luận là một điểm nghẽn lớn: trong các thử nghiệm RoboDojo, việc điều khiển tiêu tốn từ 624,8 triệu đến 1,132 tỷ token. Một lần chạy vận động kéo dài 30 giây đòi hỏi 250 lần gọi mô hình với trung bình 39,86 giây cho mỗi lần gọi khi vật lý bị tạm dừng.
Hybrid control với π0.5 đạt 48% success trên RoboDojo subset.
Trong navigation, Astra đạt 92% success trên RxR instruction following và 82% trên HM3D object search.
Một 30-second locomotion run yêu cầu 250 model calls averaging 39.86 seconds each.