RynnVLA-002: A Unified Vision-Language-Action and World Model
ABot-M0: VLA Foundation Model for Robotic Manipulation with Action Manifold Learning
Official implementation of ActQuant: Sub-4-bit Action-Guided Quantization for Vision-Language-Action Models
Evo-0: Vision-Language-Action Model with Implicit Spatial Understanding.
Les fonctionnalités principales de mint-sjtu/evo-vla sont : Embodied Foundation Models.
Les alternatives open-source à mint-sjtu/evo-vla incluent : alibaba-damo-academy/worldvla — RynnVLA-002: A Unified Vision-Language-Action and World Model. amap-cvlab/abot-manipulation — ABot-M0: VLA Foundation Model for Robotic Manipulation with Action Manifold Learning. arashakb/actquant — Official implementation of ActQuant: Sub-4-bit Action-Guided Quantization for Vision-Language-Action Models. beingbeyond/being-h — Being-H is BeingBeyond's family of human-centric embodied foundation models. beingbeyond/being-h0 — Being-H0: Vision-Language-Action Pretraining from Large-Scale Human Videos (ICML 2026). agibottech/genie-envisioner — Join our WeChat Group.