X:Unsloth (@UnslothAI)· X:Unsloth (@UnslothAI)·· 2026-08-26精选AI 评分81
Unsloth 发布 Qwen3.8-Flash-Next GGUF,75GB 内存可本地运行
AI 导读
Unsloth 推出 Qwen3.8-Flash-Next 的 GGUF 量化版本,称该 125B MoE 多模态模型性能超过 Claude-Opus-4.6 (Max),可在 75GB RAM 上本地运行,无需 GPU VRAM。
推荐理由
原文给出了本地运行所需的内存档位与量化精度权衡,读者可据此判断自己的设备能否跑动这个 MoE 模型。
正文
Qwen3.8-Flash 现在可以在本地运行了!🔥
这个 125B 的 MoE 模型表现超过了 Claude-Opus-4.6(Max)。
通过 Unsloth GGUF 在 75GB 内存上运行。
Qwen3.8-Flash-Next 让 CPU 内存 / 统一内存配置也能达到接近 VRAM 的速度。
指南:https://unsloth.ai/docs/models/qwen3.8-next
GGUF:https://huggingface.co/unsloth/Qwen3.8-Flash-Next-GGUF
来源:X:Unsloth (@UnslothAI) · x.com