跳到正文
原文
Hugging Face Blog·· 9 天前AI 评分56

Transformers 新增高效运行 llama.cpp GGUF 量化模型的支持

Transformers now runs llama.cpp quants

AI 导读

Hugging Face 为 Transformers 新增高效运行 GGUF 量化模型的支持,通过复用 ggml 内核并优化 generate,初期面向 Apple Silicon 本地推理。

来源:Hugging Face Blog · huggingface.co