RynnVLA-002: A Unified Vision-Language-Action and World Model
ABot-M0: VLA Foundation Model for Robotic Manipulation with Action Manifold Learning
Official implementation of ActQuant: Sub-4-bit Action-Guided Quantization for Vision-Language-Action Models
This is the official repository for villa-X: Enhancing Latent Action Modeling in Vision-Language-Action Models.
The main features of microsoft/villa-x are: Embodied Foundation Models.
Open-source alternatives to microsoft/villa-x include: alibaba-damo-academy/worldvla — RynnVLA-002: A Unified Vision-Language-Action and World Model. amap-cvlab/abot-manipulation — ABot-M0: VLA Foundation Model for Robotic Manipulation with Action Manifold Learning. arashakb/actquant — Official implementation of ActQuant: Sub-4-bit Action-Guided Quantization for Vision-Language-Action Models. beingbeyond/being-h — Being-H is BeingBeyond's family of human-centric embodied foundation models. beingbeyond/being-h0 — Being-H0: Vision-Language-Action Pretraining from Large-Scale Human Videos (ICML 2026). agibottech/genie-envisioner — Join our WeChat Group.