跳到正文
原文
X:Unsloth (@UnslothAI)· X:Unsloth (@UnslothAI)·· 2026-08-26精选AI 评分81

Unsloth 发布 Qwen3.8-Flash-Next GGUF,75GB 内存可本地运行

AI 导读

Unsloth 推出 Qwen3.8-Flash-Next 的 GGUF 量化版本,称该 125B MoE 多模态模型性能超过 Claude-Opus-4.6 (Max),可在 75GB RAM 上本地运行,无需 GPU VRAM。

推荐理由

原文给出了本地运行所需的内存档位与量化精度权衡,读者可据此判断自己的设备能否跑动这个 MoE 模型。

正文

Qwen3.8-Flash 现在可以在本地运行了!🔥

这个 125B 的 MoE 模型表现超过了 Claude-Opus-4.6(Max)。

通过 Unsloth GGUF 在 75GB 内存上运行。

Qwen3.8-Flash-Next 让 CPU 内存 / 统一内存配置也能达到接近 VRAM 的速度。

指南:https://unsloth.ai/docs/models/qwen3.8-next
GGUF:https://huggingface.co/unsloth/Qwen3.8-Flash-Next-GGUF

来源:X:Unsloth (@UnslothAI) · x.com