一个 17GB 的量化文件拿下 Artificial Analysis 52 分、画出本地模型史上最好的鹈鹕,但 Simon Willison 实测同一个任务默认档要 21 分钟、关掉推理只要 137 秒。这篇拆解 Qwen3.8 27B 的真实水平、「过度思考」的量化证据,以及 reasoning_effort 到底该怎么调。
Netlify 用开源评测框架 AXIS,把同一个建站提示词喂给 11 个主流模型,credit 消耗从 2.4 到 519。这是一份关于模型选型的一手实证,也是一份关于「贵到底值不值」的账单。