awesome-repositories.com
المدونة
MCP
awesome-repositories.com

اكتشف أفضل مستودعات المصادر المفتوحة باستخدام بحث مدعوم بالذكاء الاصطناعي.

استكشفعمليات بحث منسقةبدائل مفتوحة المصدربرمجيات ذاتية الاستضافةالمدونةخريطة الموقع
المشروعخادم MCPحولكيفية ترتيب النتائجالصحافة
قانونيالخصوصيةالشروط
© 2026 Bringes Technology SRL·VAT RO45896025·hello@awesome-repositories.com
·
Open-Reasoner-Zero avatar

Open-Reasoner-Zero/Open-Reasoner-Zero

0
View on GitHub↗
2,095 نجوم·120 تفرعات·Python·MIT·5 مشاهداتyasminezhang.notion.site/Open-Reasoner-Zero-19e12cf72d418007b9cdebf44b0e7903↗

Open Reasoner Zero

An Open Source Approach to Scaling Up Reinforcement Learning on the Base Model

Features

  • Critic-Based Algorithms - Scaling reinforcement learning on base models using open approaches.
  • Frontier Reasoning Models - Approach for scaling reinforcement learning on base models.
  • Reasoning Datasets - Scaling reinforcement learning on base models.
  • Reasoning Models - Zero-shot reasoning model implementation.
  • Reinforcement Learning Frameworks - Implementation of reasoning models trained with minimal data.

سجل النجوم

مخطط تاريخ النجوم لـ open-reasoner-zero/open-reasoner-zeroمخطط تاريخ النجوم لـ open-reasoner-zero/open-reasoner-zero

بحث بالذكاء الاصطناعي

استكشف المزيد من المستودعات الرائعة

صف ما تحتاجه بلغة بسيطة — وسيقوم الذكاء الاصطناعي بترتيب آلاف المشاريع مفتوحة المصدر المنسقة حسب الصلة.

Start searching with AI

الأسئلة الشائعة

ما هي وظيفة open-reasoner-zero/open-reasoner-zero؟

An Open Source Approach to Scaling Up Reinforcement Learning on the Base Model

ما هي الميزات الرئيسية لـ open-reasoner-zero/open-reasoner-zero؟

الميزات الرئيسية لـ open-reasoner-zero/open-reasoner-zero هي: Critic-Based Algorithms, Frontier Reasoning Models, Reasoning Datasets, Reasoning Models, Reinforcement Learning Frameworks.

ما هي البدائل مفتوحة المصدر لـ open-reasoner-zero/open-reasoner-zero؟

تشمل البدائل مفتوحة المصدر لـ open-reasoner-zero/open-reasoner-zero: agentica-project/rllm — 🚀 Reinforcement Learning for Language Agents🌟. skyworkai/skywork-or1 — ✊ Unleashing the Power of Reinforcement Learning for Math and Code Reasoners 🤖. hiyouga/easyr1 — EasyR1 is a distributed model training system and reinforcement learning framework for large language and… deep-agent/r1-v. gair-nlp/limo — 📄 Paper   |   🌐 Dataset (v2)   |   📘 Model (v2). deepseek-ai/deepseek-r1 — DeepSeek-R1 is an open-weights large language model focused on advanced reasoning. It uses chain-of-thought processing…

بدائل مفتوحة المصدر لـ Open Reasoner Zero

مشاريع مفتوحة المصدر مشابهة، مرتبة حسب عدد الميزات المشتركة مع Open Reasoner Zero.
  • skyworkai/skywork-or1الصورة الرمزية لـ SkyworkAI

    SkyworkAI/Skywork-OR1

    745عرض على GitHub↗

    ✊ Unleashing the Power of Reinforcement Learning for Math and Code Reasoners 🤖

    Python
    عرض على GitHub↗745
  • agentica-project/rllmالصورة الرمزية لـ agentica-project

    agentica-project/rllm

    400عرض على GitHub↗

    🚀 Reinforcement Learning for Language Agents🌟

    Jupyter Notebook
    عرض على GitHub↗400
  • deepseek-ai/deepseek-r1الصورة الرمزية لـ deepseek-ai

    deepseek-ai/DeepSeek-R1

    91,996عرض على GitHub↗

    DeepSeek-R1 is an open-weights large language model focused on advanced reasoning. It uses chain-of-thought processing and internal monologues to solve complex mathematical and logical problems by breaking tasks into sequential, verifiable thought processes. The model is developed using reinforcement learning to optimize reasoning patterns and verify logical steps. It employs a distillation process to transfer these high-performance logic capabilities from a large teacher model into smaller, computationally efficient versions. The training framework incorporates group relative policy optimiz

    عرض على GitHub↗91,996
  • deep-agent/r1-vD

    Deep-Agent/R1-V

    0عرض على GitHub↗
    عرض على GitHub↗0
عرض جميع البدائل الـ 30 لـ Open Reasoner Zero→