awesome-repositories.com
Blog
MCP
awesome-repositories.com

Descoperă cele mai bune repository-uri open source cu căutare AI.

ExploreazăCăutări recomandateAlternative open-sourceSoftware self-hostedBlogHartă site
ProiectServer MCPDespreCum realizăm clasamentulPresă
LegalConfidențialitateTermeni
© 2026 Bringes Technology SRL·VAT RO45896025·hello@awesome-repositories.com
·

6 repository-uri

Awesome GitHub RepositoriesCritic-Based Algorithms

Reinforcement learning approaches that utilize value functions or process verifiers.

Explore 6 awesome GitHub repositories matching part of an awesome list · Critic-Based Algorithms. Refine with filters or upvote what's useful.

Awesome Critic-Based Algorithms GitHub Repositories

Găsește cele mai bune repo-uri cu AI.Vom căuta cele mai potrivite repository-uri folosind AI.
  • open-reasoner-zero/open-reasoner-zeroAvatar Open-Reasoner-Zero

    Open-Reasoner-Zero/Open-Reasoner-Zero

    2,095Vezi pe GitHub↗

    An Open Source Approach to Scaling Up Reinforcement Learning on the Base Model

    Scaling reinforcement learning on base models using open approaches.

    Python
    Vezi pe GitHub↗2,095
  • prime-rl/primeAvatar PRIME-RL

    PRIME-RL/PRIME

    1,863Vezi pe GitHub↗

    ✨ Getting Started • 📖 Introduction 🔧 Usage • 📃 Evaluation • 🎈 Citation • 🌻 Acknowledgement • 📈 Star History

    Process reinforcement learning using implicit reward signals.

    Python
    Vezi pe GitHub↗1,863
  • lifan-yuan/implicitprmAvatar lifan-yuan

    lifan-yuan/ImplicitPRM

    171Vezi pe GitHub↗

    Free Process Rewards without Process Labels

    Generating process rewards without requiring explicit process labels.

    Python
    Vezi pe GitHub↗171
  • rookie-joe/autopsvAvatar rookie-joe

    rookie-joe/AutoPSV

    50Vezi pe GitHub↗

    This repository contains the official implementation of AutoPSV: Automated Process-Supervised Verifier, accepted at NeurIPS 2024 (poster).

    Automated verification for process-supervised reinforcement learning.

    Python
    Vezi pe GitHub↗50
  • hitsz-tmg/veripoAvatar HITsz-TMG

    HITsz-TMG/VerIPO

    10Vezi pe GitHub↗

    📄 Paper Link 🤗 VerIPO-7B-v1.0

    Iterative policy optimization for long-reasoning video models.

    Python
    Vezi pe GitHub↗10
  • corl-team/vl-dacAvatar corl-team

    corl-team/VL-DAC

    12Vezi pe GitHub↗

    Enhancing Vision-Language Model Training with Reinforcement Learning in Synthetic Worlds for Real-World Success

    Reinforcement learning for vision-language models in synthetic environments.

    Python
    Vezi pe GitHub↗12
  1. Home
  2. Part of an Awesome List
  3. AI & Machine Learning
  4. Critic-Based Algorithms