OpenAI:官网动态(RSS · 排除企业/客户案例)·· 2019-09-17精选AI 评分64
OpenAI 观察到多智能体交互中涌现的工具使用行为
Emergent tool use from multi-agent interaction
AI 导读
OpenAI 报告,智能体在其新构建的模拟捉迷藏环境中训练时,逐步发现越来越复杂的工具使用行为。智能体在游戏中演化出六种不同的策略与反策略,其中部分策略是团队事先不知道该环境所支持的。OpenAI 认为这种简单环境中的自监督涌现复杂性表明,多智能体协同适应未来可能产生极其复杂和智能的行为。
推荐理由
OpenAI 自述多智能体在捉迷藏环境中自发演化出六种策略与反策略,可帮助读者了解多智能体协同适应如何产生复杂行为。
来源:OpenAI:官网动态(RSS · 排除企业/客户案例) · openai.com