Simon Willison·· 20 小时前AI 评分37
Qwen3.8 27B 加法基准测试:禁用推理性能骤降,启用后几乎全对
Qwen3.8 27B addition in words
AI 导读
Qwen3.8-27B-Q4_K_M.gguf 模型在正整数加法转英文单词基准测试中,禁用推理时总准确率仅 23.57%,两位数至十三位数正确率从 97.04% 暴跌至 6.44%。启用推理后,模型在 169 个配对案例中正确回答 167 次。
来源:Simon Willison · simonwillison.net