OpenAI News·· 2019-09-17sélectionAI Score62
OpenAI 在多智能体交互中观察到工具使用的涌现
Emergent tool use from multi-agent interaction
AI Introduction
OpenAI 在模拟捉迷藏环境中训练智能体, 观察到它们在游戏过程中逐步学会使用更复杂的工具, 并形成六种不同的策略与反策略, 其中一些策略是该环境原本未预设支持的. 研究指出, 这种在简单环境中自监督涌现出的复杂性, 进一步表明多智能体共同适应未来可能产生极其复杂且智能的行为.
Raison de la recommandation
通过捉迷藏环境观察智能体自发形成六种策略与反策略, 为多智能体协同演化提供可复现的实验线索.
Source :OpenAI News · openai.com