Skip to content
@OpenRLHF

OpenRLHF

Open-sourced Reinforcment Learning from Human Feedback

Pinned Loading

  1. OpenRLHF OpenRLHF Public

    An Easy-to-use, Scalable and High-performance Agentic RL Framework based on Ray (PPO & DAPO & REINFORCE++ & VLM & TIS & vLLM & Ray & Async RL)

    Python 10k 1k

  2. OpenRLHF-M OpenRLHF-M Public archive

    An Easy-to-use, Scalable and High-performance RLHF Framework designed for Multimodal Models.

    Python 163 9

  3. OpenRLHF-Docs OpenRLHF-Docs Public

    4 6

Repositories

Showing 3 of 3 repositories
  • OpenRLHF Public

    An Easy-to-use, Scalable and High-performance Agentic RL Framework based on Ray (PPO & DAPO & REINFORCE++ & VLM & TIS & vLLM & Ray & Async RL)

    OpenRLHF/OpenRLHF's past year of commit activity
    Python 10,015 Apache-2.0 1,019 306 74 Updated Sep 17, 2026
  • OpenRLHF-Docs Public
    OpenRLHF/OpenRLHF-Docs's past year of commit activity
    4 6 1 1 Updated Apr 19, 2026
  • OpenRLHF-M Public archive

    An Easy-to-use, Scalable and High-performance RLHF Framework designed for Multimodal Models.

    OpenRLHF/OpenRLHF-M's past year of commit activity
    Python 163 Apache-2.0 9 7 1 Updated Apr 6, 2026

Top languages

Loading…

Most used topics

Loading…