Stars
2
results
for sponsorable starred repositories
Clear filter
A high-throughput and memory-efficient inference and serving engine for LLMs
Reinforcement Learning Toolkit for RWKV.(v6,v7,ARWKV) Distillation,SFT,RLHF(DPO,ORPO), infinite context training, Aligning. Exploring the possibilities for deeper fine-tuning of RWKV.