跳到正文
热点事件持续更新

ReSolve:免训练推理复用候选推理过程

1 篇报道1 个报道来源5 小时前更新

先了解这件事

AI 综述

Bangji Yang 等作者提出免训练推理方法 ReSolve,通过选择性生成式审核复用候选推理过程。在 130 道竞赛数学题、两次独立采样的候选池上,Hybrid 评分下 ReSolve 分别答对 100 和 99 题,而同样四个候选的投票只答对 91 和 92 题,且相对投票未出现由对变错的改动。 八样本自一致性在这两次评测中分别答对 94 和 96 题,但 ReSolve 的 token 消耗比它少 46.3% 和 47.2%。作者称,选择性审核与始终开启的 Uniform 审核都解出 97 题,而选择性审核减少约 54% 的审核 token、6.2% 的总流程 token。 作者也表示,这些结果未证明 ReSolve 相对额外采样有准确率优势,也未证明专门路由指令有独立收益。

AI 根据报道生成 · 2 小时前更新

报道时间线

沿着报道,了解事件的不同侧面。

10月7日
  1. arXiv:cs.AI
    ReSolve:通过选择性生成式审核复用候选推理

    ReSolve 是一种无需训练的推理方法,通过选择性生成式审核复用候选推理过程。在 130 道竞赛数学题上,Hybrid 评分下两轮评测分别答对 100 和 99 题,而同样四个候选的投票仅答对 91 和 92 题,且 token 消耗比 8 样本自一致性减少 46.3% 和 47.2%。

本事件热度走势

还没有足够的连续观测数据,暂不绘制趋势。