Series

Vima Humanoid Manip

The "Vima Humanoid Manip" series has 5 parts — read them in order from part 1.

Manipulation
VIMA Architecture: Cross-Attention Transformer Explained
manipulation

VIMA Architecture: Cross-Attention Transformer Explained

6/16/202610 min read
NT
VimaBench: 17 Tasks and 4-Level Generalization Protocol
manipulation

VimaBench: 17 Tasks and 4-Level Generalization Protocol

6/16/202615 min read
NT
Object Tokenizer: From Raw Pixels to Object Tokens with Mask R-CNN + ViT
manipulation

Object Tokenizer: From Raw Pixels to Object Tokens with Mask R-CNN + ViT

6/17/202615 min read
NT
Dataset 650K: Collecting Large-Scale Multi-Task Manipulation Data for VIMA
manipulation

Dataset 650K: Collecting Large-Scale Multi-Task Manipulation Data for VIMA

6/17/202612 min read
NT
Humanoid Adaptation: Extending VIMA to High-DoF Humanoid Robots
humanoid

Humanoid Adaptation: Extending VIMA to High-DoF Humanoid Robots

6/17/202619 min read
NT