Pinned Loading
Repositories
Showing 10 of 101 repositories
- envpool Public
C++-based high-performance parallel environment execution engine (vectorized env) for general RL environments.
-
-
- oat Public
🌾 OAT: A research-friendly framework for LLM online alignment, including reinforcement learning, preference learning, etc.
- LifelongSafetyAlignment Public
- feedback-conditional-policy Public
Code for "Language Models Can Learn from Verbal Feedback Without Scalar Rewards"