当大模型和 Agent 的个体能力持续增强时,它们的协作能力发展到了什么程度?带着这些问题,OpenAgents、哥伦比亚大学、宾夕法尼亚大学、首尔大学和宾夕法尼亚州立大学的研究者共同构建了 AgentWorld:一个面向多智能体协作能力的评测基准(benchmark)。AgentWorld 让多个由大语言模型驱动的智能体,在同一个持续变化的环境中分工、沟通、共享资源,并共同完成任务。
当大模型和 Agent 的个体能力持续增强时,它们的协作能力发展到了什么程度?带着这些问题,OpenAgents、哥伦比亚大学、宾夕法尼亚大学、首尔大学和宾夕法尼亚州立大学的研究者共同构建了 AgentWorld:一个面向多智能体协作能力的评测基准(benchmark)。AgentWorld 让多个由大语言模型驱动的智能体,在同一个持续变化的环境中分工、沟通、共享资源,并共同完成任务。