awesome-repositories.com
Blog
MCP
awesome-repositories.com

Entdecke die besten Open-Source-Repositories mit KI-gestützter Suche.

EntdeckenKuratierte SuchenOpen-Source-AlternativenSelf-hosted SoftwareBlogSitemap
ProjektÜber unsRanking-MethodikPresseMCP-Server
RechtlichesDatenschutzAGB
© 2026 Bringes Technology SRL·VAT RO45896025·hello@awesome-repositories.com
·
agentica-project avatar

agentica-project/rllm

0
View on GitHub↗
400 Stars·31 Forks·Jupyter Notebook·Apache-2.0·3 Aufrufe

Rllm

🚀 Reinforcement Learning for Language Agents🌟

Features

  • Reasoning Datasets - Open-source 14B model dataset for code reasoning.
  • Reasoning Models - Framework for reasoning-focused large language models.
  • Reinforcement Learning Frameworks - Post-training framework focused on language agents.

Star-Verlauf

Star-Verlauf für agentica-project/rllmStar-Verlauf für agentica-project/rllm

KI-Suche

Entdecke weitere awesome Repositories

Beschreibe in einfachen Worten, was du brauchst — die KI bewertet tausende kuratierte Open-Source-Projekte nach Relevanz.

Start searching with AI

Open-Source-Alternativen zu Rllm

Ähnliche Open-Source-Projekte, sortiert nach der Anzahl der gemeinsamen Funktionen mit Rllm.
  • open-reasoner-zero/open-reasoner-zeroAvatar von Open-Reasoner-Zero

    Open-Reasoner-Zero/Open-Reasoner-Zero

    2,095Auf GitHub ansehen↗

    An Open Source Approach to Scaling Up Reinforcement Learning on the Base Model

    Python
    Auf GitHub ansehen↗2,095
  • gair-nlp/limoAvatar von GAIR-NLP

    GAIR-NLP/LIMO

    1,077Auf GitHub ansehen↗

    📄 Paper | 🌐 Dataset (v2) | 📘 Model (v2)

    Python
    Auf GitHub ansehen↗1,077
  • deep-agent/r1-vD

    Deep-Agent/R1-V

    0Auf GitHub ansehen↗
    Auf GitHub ansehen↗0
  • hiyouga/easyr1Avatar von hiyouga

    hiyouga/EasyR1

    5,034Auf GitHub ansehen↗

    EasyR1 is a distributed model training system and reinforcement learning framework for large language and vision-language models. It functions as a multimodal trainer and an implementation of a Proximal Policy Optimization pipeline designed to refine the reasoning and perception capabilities of models that process both text and images. The system specializes in distributing reinforcement learning workloads across multiple compute nodes to manage high memory requirements. It optimizes hardware utilization through padding-free training and fine-tuning to fit large models onto available graphics

    Python
    Auf GitHub ansehen↗5,034
Alle 30 Alternativen zu Rllm anzeigen→

Häufig gestellte Fragen

Was macht agentica-project/rllm?

🚀 Reinforcement Learning for Language Agents🌟

Was sind die Hauptfunktionen von agentica-project/rllm?

Die Hauptfunktionen von agentica-project/rllm sind: Reasoning Datasets, Reasoning Models, Reinforcement Learning Frameworks.

Welche Open-Source-Alternativen gibt es zu agentica-project/rllm?

Open-Source-Alternativen zu agentica-project/rllm sind unter anderem: open-reasoner-zero/open-reasoner-zero — An Open Source Approach to Scaling Up Reinforcement Learning on the Base Model. inclusionai/areal — AReaL is a system for agent orchestration, distributed model training, and parameter-efficient tuning. It provides a… deep-agent/r1-v. gair-nlp/limo — 📄 Paper   |   🌐 Dataset (v2)   |   📘 Model (v2). hiyouga/easyr1 — EasyR1 is a distributed model training system and reinforcement learning framework for large language and… huggingface/open-r1 — Open-r1 is a framework designed for the large-scale training, distillation, and optimization of language models…