研究者提出并发随机博弈鲁棒PAC学习框架
热点事件持续更新
研究者提出并发随机博弈鲁棒PAC学习框架
1 篇报道1 个报道来源4 小时前更新
先了解这件事
AI 综述
Angel Y. He 与 David Parker 提出首个面向带转移不确定性的通用和并发随机博弈(CSG)的 PAC 学习框架。该框架通过维护转移核上的数据驱动 L¹ 置信集并求解鲁棒 CSG,计算社会福利最优的 ε-纳什均衡,同时应对纳什均衡存在性难题。 据作者称,在相关状态-动作对满足最小可达性条件 p_reach>0 时,算法经多项式数量的轨迹样本后终止,样本复杂度为 Õ(R_max² H⁴ |S|² |A| / (p_reach ε²))。
AI 根据报道生成 · 1 小时前更新
最新进展10月8日 12:00
面向一般和并发随机博弈的鲁棒 PAC 学习框架报道时间线
沿着报道,了解事件的不同侧面。
10月8日
- arXiv:cs.LG面向一般和并发随机博弈的鲁棒 PAC 学习框架
研究者提出首个针对带转移不确定性的通用和并发随机博弈(CSG)的 PAC 学习框架,通过维护转移核上的数据驱动 L¹ 置信集并求解鲁棒 CSG,计算社会福利最优的 ε-NE。
本事件热度走势
还没有足够的连续观测数据,暂不绘制趋势。