共 10 篇文章包含此標籤
Hugging Face 宣布 oMLX 創作者兼維護者 **Jun Kim** 加入團隊,並維持 oMLX 由 Jun
Hugging Face 將 **GGUF** 量化模型接進 `transformers`:開發者可從 Hub 選定量化
Hugging Face 將瀏覽器端 AI 的瓶頸往最底層拆解:模型格式與執行 runtime 固然重要,但實際上每次推
量化通常被視為部署時必付的效率稅:先用移除層、注意力頭或神經元的方式壓縮架構,再把權重降到 4-bit,記憶體與計算量雖
語音 AI 已進入延遲競賽時代。Hugging Face 與硬體推論新創 Cerebras 於 2026 年 7 月 1