awesome-repositories.com
المدونة
MCP
awesome-repositories.com

اكتشف أفضل مستودعات المصادر المفتوحة باستخدام بحث مدعوم بالذكاء الاصطناعي.

استكشفعمليات بحث منسقةبدائل مفتوحة المصدربرمجيات ذاتية الاستضافةالمدونةخريطة الموقع
المشروعخادم MCPحولكيفية ترتيب النتائجالصحافة
قانونيالخصوصيةالشروط
© 2026 Bringes Technology SRL·VAT RO45896025·hello@awesome-repositories.com
·

6 مستودعات

Awesome GitHub RepositoriesCritic-Based Algorithms

Reinforcement learning approaches that utilize value functions or process verifiers.

Explore 6 awesome GitHub repositories matching part of an awesome list · Critic-Based Algorithms. Refine with filters or upvote what's useful.

Awesome Critic-Based Algorithms GitHub Repositories

اعثر على أفضل المستودعات باستخدام الذكاء الاصطناعي.سنبحث عن أفضل المستودعات المطابقة باستخدام الذكاء الاصطناعي.
  • open-reasoner-zero/open-reasoner-zeroالصورة الرمزية لـ Open-Reasoner-Zero

    Open-Reasoner-Zero/Open-Reasoner-Zero

    2,095عرض على GitHub↗

    An Open Source Approach to Scaling Up Reinforcement Learning on the Base Model

    Scaling reinforcement learning on base models using open approaches.

    Python
    عرض على GitHub↗2,095
  • prime-rl/primeالصورة الرمزية لـ PRIME-RL

    PRIME-RL/PRIME

    1,863عرض على GitHub↗

    ✨ Getting Started • 📖 Introduction 🔧 Usage • 📃 Evaluation • 🎈 Citation • 🌻 Acknowledgement • 📈 Star History

    Process reinforcement learning using implicit reward signals.

    Python
    عرض على GitHub↗1,863
  • lifan-yuan/implicitprmالصورة الرمزية لـ lifan-yuan

    lifan-yuan/ImplicitPRM

    171عرض على GitHub↗

    Free Process Rewards without Process Labels

    Generating process rewards without requiring explicit process labels.

    Python
    عرض على GitHub↗171
  • rookie-joe/autopsvالصورة الرمزية لـ rookie-joe

    rookie-joe/AutoPSV

    50عرض على GitHub↗

    This repository contains the official implementation of AutoPSV: Automated Process-Supervised Verifier, accepted at NeurIPS 2024 (poster).

    Automated verification for process-supervised reinforcement learning.

    Python
    عرض على GitHub↗50
  • hitsz-tmg/veripoالصورة الرمزية لـ HITsz-TMG

    HITsz-TMG/VerIPO

    10عرض على GitHub↗

    📄 Paper Link 🤗 VerIPO-7B-v1.0

    Iterative policy optimization for long-reasoning video models.

    Python
    عرض على GitHub↗10
  • corl-team/vl-dacالصورة الرمزية لـ corl-team

    corl-team/VL-DAC

    12عرض على GitHub↗

    Enhancing Vision-Language Model Training with Reinforcement Learning in Synthetic Worlds for Real-World Success

    Reinforcement learning for vision-language models in synthetic environments.

    Python
    عرض على GitHub↗12
  1. Home
  2. Part of an Awesome List
  3. AI & Machine Learning
  4. Critic-Based Algorithms