热点事件 历史事件

Hugging Face宣布Transformers新增GGUF量化模型支持,经kernels库复用ggml Metal内核,初始面向Apple Silicon并支持Qwen3.5架构

1 篇报道1 个报道来源

先了解这件事

报道摘要

Hugging Face 宣布 transformers 支持直接运行 GGUF 量化模型,通过 from_pretrained 传入 gguf_file 即可加载 Hub 上的 GGUF checkpoint,并复用 ggml 的 Metal 内核。

摘自 Hugging Face:Blog
最新进展

历史报道归档。当前热点以新版榜单为准。

报道时间线

沿着报道,了解事件的不同侧面。

显示 1全部报道最新在前
  1. Hugging Face:Blog官方一手精选
    transformers 支持直接加载 GGUF 量化模型,本地推理性能接近 llama.cpp

    Hugging Face 宣布 transformers 支持直接运行 GGUF 量化模型,通过 from_pretrained 传入 gguf_file 即可加载 Hub 上的 GGUF checkpoint,并复用 ggml 的 Metal 内核。