跳到正文
原文
Hugging Face·· 2023-03-09精选AI 评分76

Hugging Face 推出 TRL 与 PEFT 集成:支持在 24GB 消费级 GPU 上对 20B 模型进行 RLHF 微调

Fine-tuning 20B LLMs with RLHF on a 24GB consumer GPU

AI 导读

Hugging Face 正式发布 TRL 与 PEFT 库的集成,支持在单张 24GB 消费级 GPU(如 RTX 4090)上对 20B 参数大语言模型运行基于人类反馈的强化学习(RLHF)微调。

推荐理由

通过 8-bit 量化与适配器动态切换避免双模型副本占用,为显存受限环境下跑通 RLHF 提供了具体工程参考。

来源:Hugging Face · huggingface.co