awesome-repositories.com
Blog
MCP
awesome-repositories.com

Entdecke die besten Open-Source-Repositories mit KI-gestützter Suche.

EntdeckenKuratierte SuchenOpen-Source-AlternativenSelf-hosted SoftwareBlogSitemap
ProjektMCP-ServerÜber unsRanking-MethodikPresse
RechtlichesDatenschutzAGB
© 2026 Bringes Technology SRL·VAT RO45896025·hello@awesome-repositories.com
·
ModalMinds avatar

ModalMinds/MM-EUREKA

0
View on GitHub↗
771 Stars·29 Forks·Python·Apache-2.0·7 Aufrufe

MM EUREKA

MM-EUREKA: Exploring the Frontiers of Multimodal Reasoning with Rule-based Reinforcement Learning

Features

  • Critic-Free Algorithms - Stable rule-based reinforcement learning for language models.
  • Reasoning Models - Multimodal reasoning model for complex tasks.
  • Reinforcement Learning Frameworks - Framework for reinforcement learning in multimodal reasoning.

Star-Verlauf

Star-Verlauf für modalminds/mm-eurekaStar-Verlauf für modalminds/mm-eureka

KI-Suche

Entdecke weitere awesome Repositories

Beschreibe in einfachen Worten, was du brauchst — die KI bewertet tausende kuratierte Open-Source-Projekte nach Relevanz.

Start searching with AI

Häufig gestellte Fragen

Was macht modalminds/mm-eureka?

MM-EUREKA: Exploring the Frontiers of Multimodal Reasoning with Rule-based Reinforcement Learning

Was sind die Hauptfunktionen von modalminds/mm-eureka?

Die Hauptfunktionen von modalminds/mm-eureka sind: Critic-Free Algorithms, Reasoning Models, Reinforcement Learning Frameworks.

Welche Open-Source-Alternativen gibt es zu modalminds/mm-eureka?

Open-Source-Alternativen zu modalminds/mm-eureka sind unter anderem: sail-sg/understand-r1-zero. jiayi-pan/tinyzero — TinyZero is a reinforcement learning framework and implementation designed to train language models to develop… agentica-project/rllm — 🚀 Reinforcement Learning for Language Agents🌟. deep-agent/r1-v. hiyouga/easyr1 — EasyR1 is a distributed model training system and reinforcement learning framework for large language and… inclusionai/areal — AReaL is a system for agent orchestration, distributed model training, and parameter-efficient tuning. It provides a…

Open-Source-Alternativen zu MM EUREKA

Ähnliche Open-Source-Projekte, sortiert nach der Anzahl der gemeinsamen Funktionen mit MM EUREKA.
  • sail-sg/understand-r1-zeroAvatar von sail-sg

    sail-sg/understand-r1-zero

    1,214Auf GitHub ansehen↗
    Pythonllmr1-zeroreasoning
    Auf GitHub ansehen↗1,214
  • hiyouga/easyr1Avatar von hiyouga

    hiyouga/EasyR1

    5,034Auf GitHub ansehen↗

    EasyR1 is a distributed model training system and reinforcement learning framework for large language and vision-language models. It functions as a multimodal trainer and an implementation of a Proximal Policy Optimization pipeline designed to refine the reasoning and perception capabilities of models that process both text and images. The system specializes in distributing reinforcement learning workloads across multiple compute nodes to manage high memory requirements. It optimizes hardware utilization through padding-free training and fine-tuning to fit large models onto available graphics

    Python
    Auf GitHub ansehen↗5,034
  • agentica-project/rllmAvatar von agentica-project

    agentica-project/rllm

    400Auf GitHub ansehen↗

    🚀 Reinforcement Learning for Language Agents🌟

    Jupyter Notebook
    Auf GitHub ansehen↗400
  • deep-agent/r1-vD

    Deep-Agent/R1-V

    0Auf GitHub ansehen↗
    Auf GitHub ansehen↗0
Alle 30 Alternativen zu MM EUREKA anzeigen
→