跳到正文
Hugging Face Blog·· 13 天前精选AI 评分62

Transformers 现已支持运行 llama.cpp 的 GGUF 量化模型

Transformers now runs llama.cpp quants

AI 导读

Hugging Face 为 transformers 加入 GGUF 支持,用户可从 Hub 选取量化 checkpoint,通过 from_pretrained 传入 gguf_file 即可在本地生成,无需额外配置。

推荐理由

Hugging Face 官方说明 transformers 如何直接加载 GGUF 量化权重,并给出与 llama.cpp 的对比数据,便于判断本地推理的新选择。

来源:Hugging Face Blog · huggingface.co