跳到正文
原文
X:Unsloth (@UnslothAI)· X:Unsloth (@UnslothAI)·· 2026-08-29精选AI 评分77

Unsloth 发布 GLM-5.3 GGUF 量化版本地运行指南

AI 导读

Unsloth 发布 GLM-5.3 的动态 GGUF 量化版本,2-bit 模型从 1.51TB 压缩到 239GB(缩小 83%),保留约 81% top-1 准确率,1-bit 则以缩小 85% 达到约 76%。

推荐理由

原文给出动态量化的精度与体积数据和不同位宽的硬件需求,读者可据此选择本地运行 GLM-5.3 的方案。

正文

GLM-5.3 现在可以在本地运行了!

我们将这个 2-bit 模型从 1.51TB 压缩到 239GB(体积减少 83%)后,仍保留了约 81% 的准确率。

可在 256GB 的 Mac 或相应 RAM/VRAM 配置上运行。

GLM-5.3 是迄今为止最强的开源模型。

指南:https://unsloth.ai/docs/models/glm-5.3
GGUF:https://huggingface.co/unsloth/GLM-5.3-GGUF

来源:X:Unsloth (@UnslothAI) · x.com