跳到正文
原文
Hugging Face·· 11 天前精选AI 评分74

Hugging Face Transformers 原生支持运行 llama.cpp GGUF 量化模型

Transformers now runs llama.cpp quants

AI 导读

Hugging Face 宣布在 Transformers 库中支持直接运行 llama.cpp 的 GGUF 量化模型,允许开发者通过标准的 from_pretrained API 加载适配笔记本内存的模型。

推荐理由

原文给出了在 PyTorch 与 Transformers 生态内直接运行 GGUF 的方案与性能对比,便于开发者在本地免独立推理引擎完成评测与微调。

来源:Hugging Face · huggingface.co