Series
Simplevla Rl
Series "Simplevla Rl" gồm 11 phần, đọc theo thứ tự từ phần 1.
Whole-body VLA
SimpleVLA-RL (1): Tổng quan & Ý tưởng
Giới thiệu SimpleVLA-RL — dùng RL đơn giản với reward 0/1 để cải thiện VLA model 430%, không cần reward engineering.

SimpleVLA-RL (2): Kiến trúc & Thuật toán
Deep-dive vào OpenVLA-OFT backbone, GRPO optimizer, dynamic sampling, và cơ chế exploration giúp VLA tự cải thiện.

SimpleVLA-RL (3): Setup & Training
Hướng dẫn chi tiết cài đặt môi trường, chạy SFT cold-start, và training RL cho SimpleVLA-RL trên LIBERO và RoboTwin.

SimpleVLA-RL (4): Kết quả & Bài học
Phân tích kết quả SimpleVLA-RL: ablation studies, hiện tượng pushcut, real-world transfer, và 5 bài học rút ra.
SimpleVLA-RL (5): So sánh với LeRobot
So sánh chi tiết SimpleVLA-RL và LeRobot: RL approach, VLA models, sim vs real, data efficiency — hai framework bổ trợ nhau.

SimpleVLA-RL (6): OpenArm — Phân tích Lộ trình
Phân tích chi tiết cách tiếp cận training robot OpenArm 7-DoF gắp hộp carton — so sánh 2 lộ trình: LeRobot native vs SimpleVLA-RL.
SimpleVLA-RL (7): Collect Data cho OpenArm
Hướng dẫn từng bước setup OpenArm, calibrate, teleoperate và thu thập 50 episodes gắp hộp carton với LeRobot.

SimpleVLA-RL (8): Train & Deploy trên OpenArm
Train SmolVLA, ACT, Pi0-FAST cho OpenArm gắp hộp carton — từ fine-tune đến deploy robot thật và cải thiện bằng HIL-SERL.

SimpleVLA-RL (9): OpenArm Simulation & Data
Setup OpenArm trong Isaac Lab, collect demonstration data trong simulation, và convert sang format cho SimpleVLA-RL training.

SimpleVLA-RL (10): SFT & RL Training cho OpenArm
Hướng dẫn chi tiết SFT fine-tuning và RL training với SimpleVLA-RL cho OpenArm — từ config environment đến chạy GRPO.

SimpleVLA-RL (11): Sim-to-Real cho OpenArm
Deploy model SimpleVLA-RL từ simulation lên OpenArm thật — camera setup, action mapping, và tips giảm sim-to-real gap.