VLA-JEPA

VLA-JEPA Authors

VLA-JEPA

VLA-JEPA

Checkpoint

VLA with Qwen3-VL, a flow-matching action head and a training-time V-JEPA2 world model.

Specifications

Architecture components
Flow-matching action expert
Architecture components
World-action model
Backbone
Qwen3-VL-2B + DiT action head + V-JEPA2 world model
Frameworks
LeRobot / PyTorch
Input modalities
Language instruction
Input modalities
RGB camera images
Input modalities
Robot state / proprioception
Languages
English
Model type
Vision-language-action model
Model type
World-action model
Output action space
Continuous 7-DoF action chunks and latent future predictions during training
Parameter count
3.0815B parameters
Pipeline task
Robotics

Architecture & I/O

trajectory · continuous

7 DoF

Continuous 7-DoF action chunks and latent future predictions during training

Default checkpoint

lerobot/VLA-JEPA-Pretrain

openApache License 2.0
Checkpoint

Supported robots

No verified robot compatibility recorded.

Benchmark results

No published benchmark results.

Deployment

Training data

Resources

Submit info