Simon Willison 测试 Qwen3.8 27B 英文单词加法能力
热点事件持续更新
Simon Willison 测试 Qwen3.8 27B 英文单词加法能力
1 篇报道1 个报道来源20 小时前更新
先了解这件事
AI 综述
Simon Willison 对本地 Qwen3.8 27B 模型进行了用英文单词表达正整数加法结果的测试,结果显示开启推理功能可大幅提升模型的计算准确率。 在禁用推理功能的 5070 个测试样例中,模型的数值准确率仅为 23.57%,且准确率随位数增加显著下降,从 1 至 3 位数的 97.04% 降至 10 至 13 位数的 6.44%。而在开启推理功能的 169 次尝试中,模型答对了 167 次。
AI 根据报道生成 · 1 小时前更新
最新进展10月5日 07:34
Qwen3.8 27B 英文单词加法能力测试报道时间线
沿着报道,了解事件的不同侧面。
10月5日
- Simon WillisonQwen3.8 27B 英文单词加法能力测试
一项测试评估了本地 Qwen3.8 27B 模型(`Qwen3.8-27B-Q4_K_M.gguf`)用英文单词表达正整数加法结果的能力。在禁用推理功能的 5070 个测试样例中,模型数值准确率为 23.57%,从 1 至 3 位数的 97.04% 降至 10 至 13 位数的 6.44%。开启推理功能后,模型在 169 次尝试中答对了 167 次。
本事件热度走势
还没有足够的连续观测数据,暂不绘制趋势。