Stars
Mini website for testing both general CS knowledge and enforce coding practice and common algorithm/data structure memorization.
主要记录大语言大模型(LLMs) 算法(应用)工程师相关的知识及面试题
[NeurIPS 2025 Spotlight] Official repository for "Web-Shepherd: Advancing PRMs for Reinforcing Web Agents"
adds Sequence Parallelism into LLaMA-Factory
RAGEN leverages reinforcement learning to train LLM reasoning agents in interactive, stochastic environments.