MicroDuck: Robot vịt 2 chân tập đi bằng reinforcement learning — bộ não mở trên Rust
chuanweb.com 2 phút đọc
Repo này là gì
microduck (8.617★) thuộc pollen-robotics là bộ não mã nguồn mở của chú robot vịt 2 chân nhỏ xinh (khoảng 25 cm, ~800 g) — robot này di chuyển bằng các chính sách reinforcement learning (RL) chứ không phải quỹ đạo lập trình sẵn. Repo: https://github.com/pollen-robotics/microduck.
Vì sao nó đột phá
- RL chạy thật trên robot rẻ tiền: thường RL nằm trong lab lớn; ở đây bạn thấy pipeline đầy đủ — huấn luyện trong mô phỏng (MuJoCo + PPO), chuyển sang robot thật (sim2real), export ONNX.
- Bộ não viết Rust: daemons chạy trên SoC Rockchip RK3566, vòng điều khiển 50 Hz điều khiển 15 servo từ các neural policy — vừa nhẹ vừa thời gian thực.
- Phần mềm rất đầy đủ: radio, camera, hệ thống cập nhật firmware — không phải đồ chơi demo mà là nền tảng robot thật.
- Cả repo học đi kèm:
microduck_rlchứa phần huấn luyện — bạn học lại từ đầu nếu muốn.
Bắt đầu nhanh
- Đọc kiến trúc trong repo
pollen-robotics/microduck(bộ não) vàmicroduck_rl(huấn luyện). - Nếu chỉ muốn tìm hiểu RL: cài MuJoCo và chạy pipeline PPO trong mô phỏng trước.
- Muốn robot thật: xem https://pollen-robotics.com/microduck để biết phần cứng.
Ứng dụng thực tế
- Học sim2real: nói ít, bằng chứng nhiều — một robot 800 g đi vững bằng policy học từ mô phỏng.
- Nhúng Rust + thời gian thực: ví dụ hay cho việc chạy neural net trong vòng điều khiển cứng trên SoC nhỏ.
- Giáo dục robotics: một dự án duy nhất chứa cả huấn luyện, export, deploy và điều khiển.
Kết luận và takeaways
- microduck là ví dụ hiếm hoi robotics + AI mở, gọn và đầy đủ — không phải research paper, mà là bot chạy được.
- Công thức đáng học: MuJoCo + PPO (sim) → ONNX → daemons Rust (real).
- Cho dù bạn không mua robot, phần RL và kiến trúc nhúng vẫn đáng đọc.
Ngày 24/9 đủ 3 bài! Ngày mai: compaction thông minh cho Claude Code, một “agent OS” và một kỳ tích C99. ⚡