跳到正文
原文
Hugging Face Blog·· 16 天前精选AI 评分74

Hugging Face Transformers 支持运行 llama.cpp GGUF 量化模型

Transformers now runs llama.cpp quants

AI 导读

Hugging Face 在 transformers 中加入对 GGUF 模型的高效运行支持,用户可从 Hub 选择 GGUF checkpoint,通过 from_pretrained 在本机加载并生成。

推荐理由

原文说明了 GGUF 接入 transformers 的加载方式、性能取舍和当前边界,便于评估本地推理工作流迁移。

来源:Hugging Face Blog · huggingface.co