跳到正文
热点事件持续更新

arXiv研究:自演化harness与权重训练如何分工

1 篇报道1 个报道来源2 小时前更新

先了解这件事

AI 综述

arXiv 新论文提出按智能体失败构成选择改进路径:当失败源于运行时编排时用自演化 harness,当失败属于内容类时留给权重训练。作者 Yuan Tian 等人称,自演化 harness 将 Qwen3.5-4B 在 DeepPlanning 上的留存分数从 0.16 提升至 0.30,Qwen3.5-9B 从 0.32 提升至 0.44,且 4B 模型的交付率从 55% 升至 90%。该研究同时指出,harness 进化存在收益上限,触及天花板后需转向权重训练。

AI 根据报道生成 · 2 小时前更新

报道时间线

沿着报道,了解事件的不同侧面。

10月9日
  1. arXiv:cs.AI
    Harness 进化触及天花板:何时该转向权重训练

    研究提出按智能体失败构成选择改进路径:自我进化 harness 将 Qwen3.5-4B 在 DeepPlanning 上的留存分数从 0.16 提升至 0.30,Qwen3.5-9B 从 0.32 提升至 0.44,且 4B 交付率从 55% 升至 90%,内容类失败则留给权重训练。

本事件热度走势

还没有足够的连续观测数据,暂不绘制趋势。