跳到正文
热点事件持续更新

研究:提示词给时间预算难让LLM智能体守时

1 篇报道1 个报道来源2 小时前更新

先了解这件事

AI 综述

Aaron Wang等作者发表研究,测试小模型LLM智能体能否在明确的墙钟时间预算下既按时结束、又有效利用时间。 论文称,在MLE-Bench Lite的五项竞赛中测试Qwen3.6-27B、在Zork I上测试Qwen3-4B时,仅靠提示词告知时间预算,智能体无法将预算转化为可控的时间使用。

AI 根据报道生成 · 2 小时前更新

报道时间线

沿着报道,了解事件的不同侧面。

10月9日
  1. arXiv:cs.AI
    Qwen 智能体如何在明确时间预算下按时且高效地完成任务

    研究测试了 Qwen3.6-27B 在 MLE-Bench Lite 五项竞赛、Qwen3-4B 在 Zork I 上的时间预算表现,仅靠提示词告知预算时智能体无法转化为可控时间使用。

本事件热度走势

还没有足够的连续观测数据,暂不绘制趋势。