← 返回要闻
要闻

Transformers增加GGUF运行支持,先从Apple Silicon切入

官方开始复用llama.cpp底层计算能力,让本地量化模型进入熟悉的Transformers接口。

星淬运营整理 · AI辅助。以下为来源资料摘要,不代表原作者入驻、平台独立复现或质量担保。

Hugging Face于9月22日介绍在Transformers中高效运行GGUF量化模型的工作。实现复用ggml计算内核,并减少生成过程开销,初期重点是Apple Silicon和Qwen3.5架构。

这不代表任意GGUF模型、硬件和量化方式都已兼容。阅读提示:本地部署前应同时记录模型文件、量化档位、运行库版本和内存;相同参数规模不等于相同实际速度。详细支持范围及示例以原文为准。

AI 辅助整理,由发布者核对后分享;请核对事实与不同观点,不代表各方已达成共识。

查看外部作品或体验入口
举报此内容

说明问题

处理记录