Figure 02
Robot hình người thế hệ hai điều khiển bằng mô hình thị giác–ngôn ngữ–hành động
Toàn văn của trang này được trình bày bằng tiếng Anh; tiêu đề và phần dẫn đã được bản địa hóa.
NÓ LÀ GÌ
Figure 02 is the second-generation humanoid robot Figure AI released in August 2024, designed for settings such as industry. It pairs a vision-language-action model with robot hardware so the robot can understand spoken instructions and carry out grasping and carrying tasks. Figure worked with OpenAI and demonstrated talking to the robot by voice and giving it tasks.
Vì sao đáng ghi nhớ
By connecting a vision-language-action model and a conversational speech model to a physical robot, it offers a direct demonstration of models entering the physical world.
Thông số chính
- Form
- Bipedal humanoid robot, battery-powered
- Perception
- Camera vision
- Control
- Vision-language-action model
Khái niệm liên quan
Học tăng cường sâu
Để mạng nơ-ron quyết định thẳng từ điểm ảnh — rồi giữ ổn định bằng những mẹo cũ
Sinh đa phương thức
Một mô hình học nói, vẽ, chuyển động — thậm chí mô hình hóa thế giới ba chiều
Phát hiện đối tượng
Từ “trong ảnh có gì” đến “cái gì, ở đâu và bao nhiêu”
An toàn, căn chỉnh và chèn lệnh (prompt injection)
Mô hình tối ưu chỉ số đại diện ghi trong hàm mất mát, không phải điều ta thực sự muốn — khoảng cách đó chính là toàn bộ vấn đề căn chỉnh