awesome-repositories.comCatégoriesBlog
MCP
awesome-repositories.com

Découvrez les meilleurs dépôts open-source grâce à notre recherche par IA.

ExplorerRecherches sélectionnéesAlternatives open sourceLogiciels auto-hébergésBlogPlan du site
ProjetServeur MCPÀ proposNotre méthodologiePresse
Mentions légalesConfidentialitéConditions d'utilisation
© 2026 Bringes Technology SRL·VAT RO45896025·hello@awesome-repositories.com
·
Open-Reasoner-Zero avatar

Open-Reasoner-Zero/Open-Reasoner-Zero

0
View on GitHub↗
2,095 stars·120 forks·Python·MIT·5 vuesyasminezhang.notion.site/Open-Reasoner-Zero-19e12cf72d418007b9cdebf44b0e7903↗

Open Reasoner Zero

An Open Source Approach to Scaling Up Reinforcement Learning on the Base Model

Features

  • Critic-Based Algorithms - Scaling reinforcement learning on base models using open approaches.
  • Frontier Reasoning Models - Approach for scaling reinforcement learning on base models.
  • Reasoning Datasets - Scaling reinforcement learning on base models.
  • Reasoning Models - Zero-shot reasoning model implementation.
  • Reinforcement Learning Frameworks - Implementation of reasoning models trained with minimal data.

Historique des stars

Graphique de l'historique des stars pour open-reasoner-zero/open-reasoner-zeroGraphique de l'historique des stars pour open-reasoner-zero/open-reasoner-zero

Recherche par IA

Explorez plus de dépôts awesome

Décrivez vos besoins en langage naturel — l'IA classe des milliers de projets open source sélectionnés par pertinence.

Start searching with AI

Alternatives open source à Open Reasoner Zero

Projets open source similaires, classés selon le nombre de fonctionnalités partagées avec Open Reasoner Zero.
  • skyworkai/skywork-or1Avatar de SkyworkAI

    SkyworkAI/Skywork-OR1

    745Voir sur GitHub↗

    ✊ Unleashing the Power of Reinforcement Learning for Math and Code Reasoners 🤖

    Python
    Voir sur GitHub↗745
  • agentica-project/rllmAvatar de agentica-project

    agentica-project/rllm

    400Voir sur GitHub↗

    🚀 Reinforcement Learning for Language Agents🌟

    Jupyter Notebook
    Voir sur GitHub↗400
  • deepseek-ai/deepseek-r1Avatar de deepseek-ai

    deepseek-ai/DeepSeek-R1

    91,996Voir sur GitHub↗

    DeepSeek-R1 is an open-weights large language model focused on advanced reasoning. It uses chain-of-thought processing and internal monologues to solve complex mathematical and logical problems by breaking tasks into sequential, verifiable thought processes. The model is developed using reinforcement learning to optimize reasoning patterns and verify logical steps. It employs a distillation process to transfer these high-performance logic capabilities from a large teacher model into smaller, computationally efficient versions. The training framework incorporates group relative policy optimiz

    Voir sur GitHub↗91,996
  • deep-agent/r1-vD

    Deep-Agent/R1-V

    0Voir sur GitHub↗
    Voir sur GitHub↗0
Voir les 30 alternatives à Open Reasoner Zero→

Questions fréquentes

Que fait open-reasoner-zero/open-reasoner-zero ?

An Open Source Approach to Scaling Up Reinforcement Learning on the Base Model

Quelles sont les fonctionnalités principales de open-reasoner-zero/open-reasoner-zero ?

Les fonctionnalités principales de open-reasoner-zero/open-reasoner-zero sont : Critic-Based Algorithms, Frontier Reasoning Models, Reasoning Datasets, Reasoning Models, Reinforcement Learning Frameworks.

Quelles sont les alternatives open-source à open-reasoner-zero/open-reasoner-zero ?

Les alternatives open-source à open-reasoner-zero/open-reasoner-zero incluent : agentica-project/rllm — 🚀 Reinforcement Learning for Language Agents🌟. skyworkai/skywork-or1 — ✊ Unleashing the Power of Reinforcement Learning for Math and Code Reasoners 🤖. hiyouga/easyr1 — EasyR1 is a distributed model training system and reinforcement learning framework for large language and… deep-agent/r1-v. gair-nlp/limo — 📄 Paper   |   🌐 Dataset (v2)   |   📘 Model (v2). deepseek-ai/deepseek-r1 — DeepSeek-R1 is an open-weights large language model focused on advanced reasoning. It uses chain-of-thought processing…