awesome-repositories.com
Blog
MCP
awesome-repositories.com

Entdecke die besten Open-Source-Repositories mit KI-gestützter Suche.

EntdeckenKuratierte SuchenOpen-Source-AlternativenSelf-hosted SoftwareBlogSitemap
ProjektMCP-ServerÜber unsRanking-MethodikPresse
RechtlichesDatenschutzAGB
© 2026 Bringes Technology SRL·VAT RO45896025·hello@awesome-repositories.com
·

6 Repos

Awesome GitHub RepositoriesCritic-Based Algorithms

Reinforcement learning approaches that utilize value functions or process verifiers.

Explore 6 awesome GitHub repositories matching part of an awesome list · Critic-Based Algorithms. Refine with filters or upvote what's useful.

Awesome Critic-Based Algorithms GitHub Repositories

Finde die besten Repos mit KI.Wir suchen mit KI nach den am besten passenden Repositories.
  • open-reasoner-zero/open-reasoner-zeroAvatar von Open-Reasoner-Zero

    Open-Reasoner-Zero/Open-Reasoner-Zero

    2,095Auf GitHub ansehen↗

    An Open Source Approach to Scaling Up Reinforcement Learning on the Base Model

    Scaling reinforcement learning on base models using open approaches.

    Python
    Auf GitHub ansehen↗2,095
  • prime-rl/primeAvatar von PRIME-RL

    PRIME-RL/PRIME

    1,863Auf GitHub ansehen↗

    ✨ Getting Started • 📖 Introduction 🔧 Usage • 📃 Evaluation • 🎈 Citation • 🌻 Acknowledgement • 📈 Star History

    Process reinforcement learning using implicit reward signals.

    Python
    Auf GitHub ansehen↗1,863
  • lifan-yuan/implicitprmAvatar von lifan-yuan

    lifan-yuan/ImplicitPRM

    171Auf GitHub ansehen↗

    Free Process Rewards without Process Labels

    Generating process rewards without requiring explicit process labels.

    Python
    Auf GitHub ansehen↗171
  • rookie-joe/autopsvAvatar von rookie-joe

    rookie-joe/AutoPSV

    50Auf GitHub ansehen↗

    This repository contains the official implementation of AutoPSV: Automated Process-Supervised Verifier, accepted at NeurIPS 2024 (poster).

    Automated verification for process-supervised reinforcement learning.

    Python
    Auf GitHub ansehen↗50
  • corl-team/vl-dacAvatar von corl-team

    corl-team/VL-DAC

    12Auf GitHub ansehen↗

    Enhancing Vision-Language Model Training with Reinforcement Learning in Synthetic Worlds for Real-World Success

    Reinforcement learning for vision-language models in synthetic environments.

    Python
    Auf GitHub ansehen↗12
  • hitsz-tmg/veripoAvatar von HITsz-TMG

    HITsz-TMG/VerIPO

    10Auf GitHub ansehen↗

    📄 Paper Link 🤗 VerIPO-7B-v1.0

    Iterative policy optimization for long-reasoning video models.

    Python
    Auf GitHub ansehen↗10
  1. Home
  2. Part of an Awesome List
  3. AI & Machine Learning
  4. Critic-Based Algorithms