Skip to content
@OpenRLHF

OpenRLHF

Open-sourced Reinforcment Learning from Human Feedback

Pinned Loading

  1. OpenRLHFOpenRLHFPublic

    An Easy-to-use, Scalable and High-performance Agentic RL Framework based on Ray (PPO & DAPO & REINFORCE++ & VLM & TIS & vLLM & Ray & Async RL)

    Python 9.9k 1k

  2. OpenRLHF-MOpenRLHF-MPublic archive

    An Easy-to-use, Scalable and High-performance RLHF Framework designed for Multimodal Models.

    Python 163 9

  3. OpenRLHF-DocsOpenRLHF-DocsPublic

    4 6

Repositories

Showing 3 of 3 repositories

Top languages

Loading…

Most used topics

Loading…