跳到正文
热点事件持续更新

Qwen3.8-27B 4比特量化版 DeepSWE 单题跑出98%引质疑

1 篇报道1 个报道来源2 小时前更新

先了解这件事

AI 综述

2026年10月2日,Reddit 用户 Distinct-Pie2389 发帖称,Qwen3.8-27B 的 4 比特量化版在 DeepSWE 单道编程题上通过了 98% 的测试,并在代码审查任务中拿到 12/12。Wccftech 报道称,同一道题上云端前沿模型的平均成绩为 96.6%。该帖随后被以“为何仍不该轻信”的角度讨论,指出这一结果来自单道题目的个例,尚不足以代表模型整体能力。目前事件仍停留在单一用户自测与媒体转述阶段,没有更多独立复现或官方回应。

AI 根据报道生成 · 2 小时前更新

报道时间线

沿着报道,了解事件的不同侧面。

10月2日
  1. Google AI:DEV 作者专属
    Qwen3.8-27B 4 比特量化版在 DeepSWE 单题上跑出 98%,为何仍不该轻信

    Reddit 用户 Distinct-Pie2389 称 Qwen3.8-27B 的 4 比特量化版在 DeepSWE 单道编程题上通过 98% 测试,并在代码审查任务拿到 12/12,Wccftech 称同题云端前沿模型平均为 96.6%。

本事件热度走势

还没有足够的连续观测数据,暂不绘制趋势。