Signal YCurated AI News
更新于 8/20 09:5261 个信源

Qwen 3.8 27B 表现出色,但默认会疯狂想太多

通用 AI8/17 06:00Simon Willison查看原文 ↗
摘要

Simon Willison 评测了阿里开源的 Qwen 3.8 27B 模型,发现其默认启用 xhigh 推理强度导致严重过度思考,造成计算浪费。

核心要点
  • Qwen 3.8 27B 是阿里 Qwen 实验室发布的开源模型,27B 参数,Apache 2 许可,支持视觉能力。
  • 官方支持 reasoning_effort 参数,默认 xhigh,可选 medium 和 low,用于调节推理深度与成本。
  • 在 LM Studio 中,默认 8192 token 上下文会被思考耗尽,需扩展至 262,144 token 才能正常使用。
  • 默认设置下生成鹈鹕骑自行车 SVG 耗时 21 分钟,消耗 22,276 推理 token 产出 3,223 token。
  • 关闭推理后,同一提示耗时 137 秒,产出 3,715 token,效率大幅提升。
原文佐证
  • It took 21 minutes to generate, using 22,276 reasoning tokens to produce 3,223 tokens of output.
  • This one produced 3,715 tokens and took 137s - just over two minutes.
AI 洞察
这次评测暴露了开源模型在追求基准高分与端侧实际体验之间的矛盾,默认高推理强度会消耗大量算力却未必带来收益。随着小参数模型进入个人设备,推理效率与默认参数调优将成为关键竞争力,厂商可能需要针对不同场景设计更合理的默认配置。