💬 观点Simon Willison
Qwen 3.8 27B is excellent, but it defaults to wildly — Qwen 3.8 27B 本地模型性能出色,但默认过度思考,需调低推理级别。
Qwen 3.8 27B 本地模型性能出色,但默认过度思考,需调低推理级别。
2026-08-16原文
本文为要点摘要,完整细节以原文为准。
🧭 一图看懂
由原文自动提炼 · 以原文为准点击任一分支,查看这一点的一句话解读
Qwen 3.8 27B 本地模型评测
模型默认 xhigh 推理级别,简单问题也消耗大量 token
- 画圆用 22,276 推理 token,耗时 21 分钟
- LM Studio 默认 8,192 上下文被思考占满
- 建议改用 low 或关闭推理
⚙️ 流程拆解
STEP 1下载 Qwen 3.8 27B 量化模型
STEP 2在 LM Studio 加载并调大上下文
STEP 3将 reasoning_effort 设为…
STEP 4输入提示词测试生成或视觉任务
🔗 涉及的概念与玩家
- Qwen 3.8 27B模型
- Alibaba公司
- LM Studio产品
- NVIDIA DGX Spark产品
- Simon Willison人物
- Qwen 3.6 27B模型
- Qwen 3.7-Plus模型
- reasoning_effort概念
- Alibaba—发布→Qwen 3.8 27B
- Qwen 3.8 27B—超越→Qwen 3.6 27B
- Qwen 3.8 27B—超越→Qwen 3.7-Plus
- Simon Willison—评测→Qwen 3.8 27B
- LM Studio—运行→Qwen 3.8 27B
- Qwen 3.8 27B—支持→reasoning_effort
- Qwen 3.8 27B 是 Apache 2 许可的 27B 参数视觉模型,适合在笔记本上运行,但默认推理级别为 xhigh,导致简单任务也消耗大量 token 和等待时间。
- 作者实测,生成一个 SVG 图像在默认设置下需 21 分钟,而关闭推理后仅需 2 分钟,建议用户优先使用 low 或关闭推理。
- 模型在边界框标注任务上表现优秀,能准确识别图像中的物体,且能自主构建工具,但过度思考会带来不必要的复杂性。
- 对开发者而言,本地模型的能力已足够强大,但需注意默认配置可能影响效率,合理调整推理参数是关键。
原文:Qwen 3.8 27B is excellent, but it defaults to wildly overthinking things · 作者 Simon Willison
🕸 顺着图谱继续读
- CORS Chat — 用CORS Chat测试本地LLM端点,支持流式SVG渲染。2026-08-15 · 共同涉及 Simon Willison、LM Studio、Qwen 3.8 27B
- Introducing Hy4 Preview — 腾讯发布Hy4预览版:770B参数、1M上下文,推理模式仅两档。2026-08-29 · 共同涉及 Simon Willison、reasoning_effort
- Qwen 3.8 27B scores 52 on the Artificial Analysis — 27B 小模型追平 GPT2026-08-17 · 共同涉及 Qwen 3.8 27B、Simon Willison
- Introducing Muse Glimmer — Meta 新开源 30B 模型 Muse Glimmer,主打端到端智能体任务完2026-08-10 · 共同涉及 LM Studio、Simon Willison