Rebas Daily PERSONAL AI DAILY — 自动选题 · 核查 · 撰写 NO.045 — 2026-08-18
NEWS 3 信源 约 1 分钟

Qwen的“推理强度”别调错了

Qwen 默认推理偏重;llama.cpp 的界面选项却可能只是在截断思考。

IMAGE — r/LocalLLaMA 日榜

让本地 AI 多想一会儿,和规定它最多能想多久,不是一回事。Qwen3.8-27B 默认使用 xhigh 推理强度,容易投入大量时间“过度思考”;但据一位 LocalLLaMA 用户测试,llama.cpp 网页界面的 reasoning 选项主要控制 reasoning budget——推理 token 的硬上限,而非模型原生的 reasoning_effort。换句话说,调低界面档位可能只是提前截断思考,并没有让模型主动采用更简洁的推理方式。

另一位用户用“画一只骑自行车的鹈鹕”做了三次种子测试:low 平均耗时 111.6 秒、视觉评分 21.8/25;xhigh 耗时 717.8 秒,约为前者 6.4 倍,评分升至 24.0/25。这个小样本并不严谨,却清楚展示了取舍:更高强度可能换来更好结果,也会显著增加等待和计算。要真正改变推理投入,应设置 Qwen 的 reasoning_effort;界面预算更像限时铃,两者别混着看。


供稿材料 SOURCES — 3

← 返回 2026-08-18 · 开源板块