Hugging Face·· 11 天前精选AI 评分74
Hugging Face Transformers 原生支持运行 llama.cpp GGUF 量化模型
Transformers now runs llama.cpp quants
AI 导读
Hugging Face 宣布在 Transformers 库中支持直接运行 llama.cpp 的 GGUF 量化模型,允许开发者通过标准的 from_pretrained API 加载适配笔记本内存的模型。
推荐理由
原文给出了在 PyTorch 与 Transformers 生态内直接运行 GGUF 的方案与性能对比,便于开发者在本地免独立推理引擎完成评测与微调。
来源:Hugging Face · huggingface.co