跳到正文

全部动态

今日 179 条
9月30日周三
  1. arXiv:cs.AI(全量分类)39

    视觉敏感不等于主张可撤回:多模态强化学习中的持久性感知信用分配

    针对多模态强化学习中视觉敏感度与主张可撤回性的脱节问题,研究者提出持久性感知信用门控(PACG),通过衰减异常持久视觉主张的正向信用来修正信用分配。在 Qwen2.5-VL-7B 上,PACG 将 DAPO 的九基准三种子平均分从 58.1% 提升至 59.9%,VPPO 从 59.8% 提升至 60.9%,同时使无图像支持的主张更易撤回,且无需标注、不增加推理成本。

  2. arXiv:cs.AI(全量分类)33

    BRIDGE:面向检索信用感知的双层智能体强化学习

    BRIDGE 是一种内存高效的一阶双层优化方法,将检索器与 LLM 策略的联合训练建模为双层优化问题,以解决检索证据错误被错误归咎于 LLM 策略的"信息信用鸿沟"。在七个开放域 QA 基准上,BRIDGE 在 3B 和 7B 骨干下均取得最高平均准确率,多跳平均较最强基线分别提升 9.6 和 3.4 EM 点,并在医疗 QA 基准上取得最佳平均答案准确率与推理质量。

  3. arXiv:cs.AI(全量分类)29

    AVIO:在音视频场景中学习添加与移除发声物体

    研究团队提出 AVIO,通过源条件特征调制改造预训练文本到音视频生成模型,让单一模型同时学会添加和移除发声物体,并支持仅凭指令编辑或可选视觉引导。配套数据集 AVIOBench 包含 37.9 小时配对音视频样本、覆盖 1,878 个目标物体名称,用共享身份与视觉掩码关联物体的视觉存在与声音贡献。参考帧课程训练逐步减少参考条件,使模型在添加物体时可通过可选参考控制外观与位置。

  4. arXiv:cs.AI(全量分类)24

    人机协作:从悖论到模式

    一篇论文从自主性与主动性两个设计维度考察人机协作,用悖论视角分析其中的内在张力,并据此映射出四种协作模式:指令、委派、辅助与共创。该工作将发表于第33届模式语言编程会议(PLoP 2026)。

  5. arXiv:cs.AI(全量分类)33

    再生公地中无崩溃的收获学习:一个拉格朗日框架

    研究者将再生公地建模为带设计者指定消耗预算的约束马尔可夫博弈或约束多智能体 MDP,提出非平稳拉格朗日框架,用无约束博弈或协作控制问题的解构造策略序列。该框架引入面向重置回合、带折扣奖励与终端成本的平均 epoch 解概念,并证明与奖励无关的可行性证书、协作可行性与近似最优性。

  6. arXiv:cs.AI(全量分类)38

    安全算子:通过谱优化调控安全指令的表达

    研究者提出"安全算子"概念,指出基于 Transformer 的语言模型中上下文 token 可被吸收为模型权重的乘法算子,其主特征值可连续调节安全指令对生成的影响强度。他们据此推导出带抑制权重的对比安全损失,通过调节该权重在有害与无害查询间权衡,映射出攻击成功率与过度拒答率之间的关系,并在不同参数化下获得 Pareto 改进的安全指令。

  7. arXiv:cs.AI(全量分类)36

    关系基础模型在上下文学习中的支持集目标泄漏:模型依赖性与评估可靠性

    研究揭示关系型上下文学习(ICL)中的支持集目标泄漏问题:当支持上下文包含目标衍生特征而查询端不可用时,评估结果会失真。作者构造 20 个目标衍生特征,在 13 个 RelBench 任务和 5 种关系 ICL 配置上测试,发现 0-hop 与 Full 泄漏造成最大偏差,且泄漏效应高度依赖任务与模型,甚至可逆转模型变体间的相对结论。

  8. arXiv:cs.AI(全量分类)32

    ARCagent:面向临床问答的自适应检索校准智能体

    ARCagent 是面向 ME/CFS 临床问答的自适应检索校准智能体,在 LLM-as-Judge 评测中达到 95.3%,超过所有基线 LLM。它构建了 1,706 个文本块、10 个来源的知识库,并配有覆盖现有 ME/CFS 诊断框架的指南间冲突登记表,以及按查询焦点与冲突信号重排证据的校准流程。该评测避免了关键词匹配平均 10.1 个百分点的系统性低估,代码已开源。

  9. arXiv:cs.AI(全量分类)38

    简单机制接口如何引导 LLM 智能体决策:arXiv 研究

    一项 arXiv 研究在拍卖与匹配等多智能体环境中比较不同交互格式对 LLM 智能体决策的影响,发现英式拍卖接口能显著降低出价偏差。研究还显示,列出收益情形并解释真实出价为何安全可改善选择,而要求智能体规划匹配轮次或推测对手信念反而整体变差。在拍卖中,这些行为改善并未伴随智能体简短计划中策略理解语言指标的相应提升。

  10. arXiv:cs.AI(全量分类)39

    用 LLM 引导剪枝改进最近邻图索引

    研究者提出 LLM-Guided Graph Pruning(LGP)框架,用 LLM 推理直接优化已有 ANN 图索引,把结构上"低价值"的邻居替换为 LLM 选出的语义替代项,同时保留原图的稀疏性与可导航性。在 DiskANN 和 HNSW 等图索引上,LGP 在语义检索基准中端到端表现稳定优于贪心图搜索和 LLM 重排序。

  11. arXiv:cs.AI(全量分类)33

    HyperZip:用超网络与个性化扩散 LLM 实现高效数据压缩

    HyperZip 是一个基于扩散 LLM(dLLM)与 Multi-Token Prediction 的 LLM 数据压缩框架,通过超网络从上下文表示生成数据专属更新,无需微调即可适配目标数据。它针对扩散压缩中解码吞吐量提升会降低压缩率的权衡,实现了低压缩率与高吞吐的兼顾,在压缩率与速度的权衡上优于现有 SOTA 基线。

  12. arXiv:cs.AI(全量分类)35

    ThuRunel:面向结构化咨询对话的动态解耦

    ThuRunel 是一个面向医疗美容、法律咨询、教育规划等高风险咨询场景的 AI 咨询智能体,通过有限状态信念管理框架、思维链教师合成协议与学习式生成适配器实现动态解耦。在 11 个基线对比中,ThuRunel 在信息采集完整度与专家简报质量上均取得一致提升。该智能体已以双语 Web 应用形式公开部署,基于精选知识库在每次回答中标注引用来源。

  13. arXiv:cs.AI(全量分类)40

    StateTape:面向长程编程智能体的动作条件证据生命周期建模

    针对长程编程智能体上下文随观察不断增长的问题,论文提出 StateTape 框架,将仓库建模为符号级代码图,用 tape 标记每次写入改动的符号,把过时判断从文本推断变为对写入的观察。该方法配合小型 manager 模型处理写入日志无法确定的部分,并给出理论分析与 TraceBench 基准。在六个编程智能体和三个编辑密集型基准上,StateTape 均取得更高解决率且计算开销很小。

  14. arXiv:cs.AI(全量分类)39

    OTROPE:基于最优传输的大语言模型鲁棒离线策略评估

    研究者提出 OTROPE,一种无需似然函数的 LLM 离线策略评估方法,通过最优传输在语义空间做分布校正,将行为策略的标注样本与目标策略的无标注样本对齐。它结合校正后的人类标注残差与代理预测器,无需行为策略建模或密度比估计,即可实现双重鲁棒式评估。实验显示 OTROPE 持续优于基线,并能让较弱 LLM 评估器集成逼近甚至超越更强评估器,代码已开源。

  15. arXiv:cs.AI(全量分类)41

    如何缓解大型推理模型中的欺骗性安全对齐

    针对大型推理模型(LRM)中推理链与最终答案安全信号不一致的"欺骗性安全对齐"现象,研究者提出 DSAR 指标进行量化,发现该现象在标准提示下普遍存在,并在 prefilling 攻击下显著放大。为此提出基于 RL 的 SARA 方法,同时奖励安全感知推理与安全最终答案,在标准与对抗设置下均显著缓解该问题,并保持有用性与效用。

  16. arXiv:cs.AI(全量分类)35

    CoRe:协同演化奖励模型,缓解视频扩散模型中的潜在奖励攻击

    针对固定潜在奖励模型优化会导致"潜在奖励攻击"、生成视频感知与运动质量下降的问题,研究者提出协同演化奖励框架 CoRe,持续用生成器当前样本重训奖励模型并锚定真实视频偏好,防止生成器通过偏离数据分布刷高奖励。在 Wan2.1-T2V-1.3B 上,CoRe 的生成质量优于预训练模型和既有对齐方法,且避免了固定奖励优化的质量崩溃。

  17. arXiv:cs.AI(全量分类)31

    MERID:用递归自我改进智能体做多模态抑郁症分析

    研究者提出 MERID 框架,通过基于经验的递归自我改进(RSI)自动开发抑郁症预测流水线,包含 Grounded State Construction、Coupled Pipeline Exploration 和 Evidence-Guided Evolution 三个组件。在抑郁症基准上,MERID 在多项任务上优于多模态与智能体基线,分析还显示声学与语言线索对抑郁症检测有价值,代码已开源。

  18. arXiv:cs.AI(全量分类)37

    欧盟 AI 法案合规检查工具(AIACC)的实证研究与评估

    研究首次对 12 款主流欧盟 AI 法案合规检查工具(AIACC)进行实证评估,发现其质量差异显著,目前只能作为早期定位工具。这些工具交互模式与易用性不一致,倾向过度简化或遗漏关键义务,且无法提供明确可执行的指导,依赖它们可能造成虚假的合规感。研究据此提出更可靠合规支持工具的设计原则。

  19. arXiv:cs.AI(全量分类)35

    FigAct:把科学图表变成可交互讲解画布

    研究者提出 FigAct 框架,将静态科学图表转化为按问题定制的可视化演示,直接在图表现有图形元素上施加视觉动作以引导读者注意力。其分层搜索策略将元素定位的 token 消耗降低约 40 倍,并基于 grounding 准确率、搜索效率和渲染质量三项奖励训练出 FigAct-8B。团队还构建了经人工核验的真实论文图表 benchmark,用于评估 MLLM 生成有据可依的视觉解释的能力。

  20. arXiv:cs.AI(全量分类)35

    AdaST:面向时空预测的自适应耦合框架

    AdaST 是一个自适应时空预测框架,通过"分解-重组"范式,用异质性感知专家将输入分解为不同耦合模式的组件,再由角色对齐模块处理并经相关性感知的自适应重组器整合输出预测。研究指出真实时空数据存在时间主导、空间主导和强耦合等不同耦合机制,现有方法隐含假设强时空耦合会导致虚假依赖和性能下降。该工作已被 NeurIPS 2026 主会接收,实验显示 AdaST 显著优于当前最优基线。