awesome-repositories.com
Blog
MCP
awesome-repositories.com

Descoperă cele mai bune repository-uri open source cu căutare AI.

ExploreazăCăutări recomandateAlternative open-sourceSoftware self-hostedBlogHartă site
ProiectServer MCPDespreCum realizăm clasamentulPresă
LegalConfidențialitateTermeni
© 2026 Bringes Technology SRL·VAT RO45896025·hello@awesome-repositories.com
·
Open-Reasoner-Zero avatar

Open-Reasoner-Zero/Open-Reasoner-Zero

0
View on GitHub↗
2,095 stele·120 fork-uri·Python·MIT·5 vizualizăriyasminezhang.notion.site/Open-Reasoner-Zero-19e12cf72d418007b9cdebf44b0e7903↗

Open Reasoner Zero

An Open Source Approach to Scaling Up Reinforcement Learning on the Base Model

Features

  • Critic-Based Algorithms - Scaling reinforcement learning on base models using open approaches.
  • Frontier Reasoning Models - Approach for scaling reinforcement learning on base models.
  • Reasoning Datasets - Scaling reinforcement learning on base models.
  • Reasoning Models - Zero-shot reasoning model implementation.
  • Reinforcement Learning Frameworks - Implementation of reasoning models trained with minimal data.

Istoric stele

Graficul istoricului de stele pentru open-reasoner-zero/open-reasoner-zeroGraficul istoricului de stele pentru open-reasoner-zero/open-reasoner-zero

Căutare AI

Explorează mai multe repository-uri excelente

Descrie ce ai nevoie în limbaj simplu — AI-ul sortează mii de proiecte open source selectate în funcție de relevanță.

Start searching with AI

Întrebări frecvente

Ce face open-reasoner-zero/open-reasoner-zero?

An Open Source Approach to Scaling Up Reinforcement Learning on the Base Model

Care sunt principalele funcționalități ale open-reasoner-zero/open-reasoner-zero?

Principalele funcționalități ale open-reasoner-zero/open-reasoner-zero sunt: Critic-Based Algorithms, Frontier Reasoning Models, Reasoning Datasets, Reasoning Models, Reinforcement Learning Frameworks.

Care sunt câteva alternative open-source pentru open-reasoner-zero/open-reasoner-zero?

Alternativele open-source pentru open-reasoner-zero/open-reasoner-zero includ: agentica-project/rllm — 🚀 Reinforcement Learning for Language Agents🌟. skyworkai/skywork-or1 — ✊ Unleashing the Power of Reinforcement Learning for Math and Code Reasoners 🤖. hiyouga/easyr1 — EasyR1 is a distributed model training system and reinforcement learning framework for large language and… deep-agent/r1-v. gair-nlp/limo — 📄 Paper   |   🌐 Dataset (v2)   |   📘 Model (v2). deepseek-ai/deepseek-r1 — DeepSeek-R1 is an open-weights large language model focused on advanced reasoning. It uses chain-of-thought processing…

Alternative open-source pentru Open Reasoner Zero

Proiecte open-source similare, clasificate după numărul de funcționalități comune cu Open Reasoner Zero.
  • skyworkai/skywork-or1Avatar SkyworkAI

    SkyworkAI/Skywork-OR1

    745Vezi pe GitHub↗

    ✊ Unleashing the Power of Reinforcement Learning for Math and Code Reasoners 🤖

    Python
    Vezi pe GitHub↗745
  • agentica-project/rllmAvatar agentica-project

    agentica-project/rllm

    400Vezi pe GitHub↗

    🚀 Reinforcement Learning for Language Agents🌟

    Jupyter Notebook
    Vezi pe GitHub↗400
  • deepseek-ai/deepseek-r1Avatar deepseek-ai

    deepseek-ai/DeepSeek-R1

    91,996Vezi pe GitHub↗

    DeepSeek-R1 is an open-weights large language model focused on advanced reasoning. It uses chain-of-thought processing and internal monologues to solve complex mathematical and logical problems by breaking tasks into sequential, verifiable thought processes. The model is developed using reinforcement learning to optimize reasoning patterns and verify logical steps. It employs a distillation process to transfer these high-performance logic capabilities from a large teacher model into smaller, computationally efficient versions. The training framework incorporates group relative policy optimiz

    Vezi pe GitHub↗91,996
  • deep-agent/r1-vD

    Deep-Agent/R1-V

    0Vezi pe GitHub↗
    Vezi pe GitHub↗0
Vezi toate cele 30 alternative pentru Open Reasoner Zero→