PipelineLLM

(★ 33)

PipelineLLM 是一个系统性的大语言模型(LLM)后训练学习项目,涵盖从监督微调(SFT)到偏好优化(DPO)、强化学习(RLHF/PPO/GRPO)再到持续学习(Continual Learning)的完整技术栈。

PipelineLLM 최신버젼 다운로드

최종 버전 다운로드 (.zip)
// repository documentation