README.md
以下内容由 AI 翻译,如有问题请点此提交 issue 反馈
这是由 Swarms 团队整理的最佳多智能体研究论文精选列表。我们在 Swarms 的使命是研究多智能体系统。立即加入我们的 Discord!
格式
- [论文名称] [描述] [链接]
多智能体协作与系统设计
- 多智能体协作中的思维通信
- MAS-Zero:零监督设计多智能体系统
- 基于大语言模型的 K 级推理
- 更多智能体即所需
- LongAgent:通过多智能体协作将语言模型扩展至 128k 上下文
- AgentScope:一个灵活且健壮的多智能体平台
- 学习使用多个语言模型进行协作解码
- AIOS:LLM 智能体操作系统
- AutoGen:通过多智能体对话实现下一代 LLM 应用
- 智能体链:大语言模型在长上下文任务上的协作
- 智能体混合增强大语言模型能力
- EvoAgent:通过进化算法实现自动多智能体生成
- 智能体互联网:编织异构智能体网络以实现协作智能
- 基于思维混合表示的大语言模型级联用于高效推理
- 优化基于 LLM 的智能体协作
- LLM-Agent-UMF:基于 LLM 的智能体统一建模框架
- Optima:优化基于 LLM 的多智能体系统的有效性与效率
- SwarmAgentic:通过群体智能实现全自动智能体系统生成
- AGENTSNET:多智能体 LLM 中的协调与协作推理
- LLM Economist: 大规模群体模型与多智能体生成模拟中的机制设计
- SOTOPIA-RL: 面向社交智能的奖励设计
- Talk Isn't Always Cheap: 理解多智能体辩论中的失败模式
- Virtual Agent Economies
- Federation of Agents: 面向大规模智能体 AI 的语义感知通信架构
- In-the-Flow Agentic System Optimization for Effective Planning and Tool Use
- Rethinking Mixture-of-Agents: 混合不同大语言模型是否有益?
- TUMIX: 基于工具使用混合的多智能体测试时扩展
- Achilles Heel of Distributed Multi-Agent Systems
- CAMEL: 用于探索大语言模型社会“心智”的通信智能体
- Multi-Agent Collaboration: 驾驭智能 LLM 智能体的力量
- Rethinking the Bounds of LLM Reasoning: 多智能体讨论是关键吗?
- MAgIC: 探究大语言模型驱动的多智能体在认知、适应性、理性与协作方面的表现
- LLM Harmony: 用于问题求解的多智能体通信
- Multi-Agent Consensus Seeking via Large Language Models
- Shall We Team Up: 探索竞争 LLM 智能体的自发合作
- Cooperative Strategic Planning Enhances Reasoning Capabilities in Large Language Models
- SMoA: 通过稀疏智能体混合改进多智能体大语言模型
- 基于大语言模型(LLM)的自适应性多智能体系统
- 小语言模型的战略协调框架在数据合成中媲美大语言模型
- 跨环境合作实现零样本多智能体协调
- 解锁多智能体 LLM 在推理中的潜力:从惰性智能体到深思熟虑
- The Station:一个用于 AI 驱动探索的开放世界环境
- 迈向智能体系统扩展的科学
- RouteMoA:无需预推理的动态路由提升高效智能体混合
- 智能 AI 委托
- AI 智能体社会中是否会出现社会化?以 Moltbook 为例
- 通过上下文内合作者推理实现多智能体协作
- SkillOrchestra:通过技能转移学习智能体路由
- LLM 协作中多智能体强化学习的上下文反事实信用分配 GitHub
- CORAL:迈向开放式探索的自主多智能体进化
- TRINITY:一个进化的 LLM 协调器
- 使用 Conductor 在自然语言中学习编排智能体
- 从技能到人才:将异构智能体组织为现实世界中的公司
- AI 智能体能否达成一致?
- ARIS:通过对抗性多智能体协作实现自主研究
- 超越个体智能:综述基于 LLM 的多智能体系统中的协作、失败归因与自我进化
- AgentFugue:通过集体推理实现长时程任务的智能体扩展
- DarkForest:多智能体 LLM 少言多准
- AgensFlow:多智能体系统的协调策略基底
- 当云端智能体遇上设备智能体:混合多智能体系统的经验教训
- 多智能体推理中的流式通信
- 智能体该说什么?面向高效多智能体系统的动作-状态通信
- SearchSwarm:迈向 Agentic LLM 中的委托智能,用于长时程深度研究
- 具有共享上下文的去中心化多智能体系统
- Sakana Fugu 技术报告
- LLM 智能体通信协议的技术分类学
- 扩展规模能改善基于 LLM 的社会模拟吗?
多智能体框架与基准测试
- MALLM:多智能体大语言模型框架
- AgentGym:在多样化环境中演进基于大语言模型的智能体
- AgentScope 中的超大规模多智能体模拟
- AgentClinic:面向临床环境 AI 的多模态智能体基准测试
- MultiAgentBench:评估 LLM 智能体的协作与竞争
- TheAgentCompany:在具有重大影响的现实世界任务上对 LLM 智能体进行基准测试
- BoxingGym:自动化实验设计进展的基准测试
- Symphony:用于可扩展集体智能的去中心化多智能体框架
- CoMAS:通过交互奖励协同演进多智能体系统
- 协作鸿沟
- API-Bank:面向工具增强型 LLM 的综合基准测试
- AutoAgents:自动智能体生成框架
- MAS-GPT:训练 LLM 构建基于 LLM 的多智能体系统
- 通过演进式编排实现多智能体协作
- TCAndon-Router:用于多智能体协作的自适应推理路由器
- 多智能体讨论中的上下文学习
- 视觉虫洞:异构多智能体系统中的潜在空间通信
- EvoSkill:多智能体系统的自动化技能发现
特定应用的多智能体系统
软件工程
- 使用大语言模型进行自动化单元测试改进
- 软件开发智能体的经验协同学习
- ChatDev: 用于软件开发的通信智能体
- MAGIS: 基于 LLM 的用于 GitHub 问题解决的智能体框架
- CodeR: 基于多智能体和任务图的问题解决
- 从 LLM 到基于 LLM 的软件工程智能体:综述
- CodexGraph: 通过代码图数据库连接大语言模型与代码仓库
- 多样性赋能智能:整合软件工程智能体的专业知识
- 基于大语言模型的软件工程智能体:综述
- AutoSafeCoder: 用于保障 LLM 代码生成的多智能体框架
- RGD: 基于多 LLM 的通过精炼与生成引导的智能体调试器
- CoAct-1: 以编码为动作的计算机使用智能体
- 自组织智能体:面向超大规模代码生成与优化的 LLM 多智能体框架
- 人在回路的软件开发智能体
- 基于 LLM 的软件工程多智能体系统:愿景与未来之路
- 基于 LLM 的软件工程多智能体系统:文献综述、愿景与未来之路
- 精准定制:用于开放域流程定制的基于编辑的智能体
- Agents4PLC: 使用基于 LLM 的智能体在工业控制系统中自动化闭环 PLC 代码生成与验证
- 扩展长时程自主编码 Cursor 的一篇博客
- 迈向自驱动代码库 作者为 Cursor
- 长时程应用开发的框架设计
医疗保健与医学
- Agent Hospital: 一个具有可进化医疗智能体的医院模拟体
- MEDCO: 基于多智能体框架的医学教育副驾驶
- 基于多智能体的边缘设备医疗助手
- AI 智能体能否设计和实施药物发现流程?
- 基于语言模型的顺序诊断 ||开源实现 代码链接
- 迈向 AI 共同科学家 --- 实现
- AI 智能体的虚拟实验室设计新型 SARS-CoV-2 纳米抗体
- Cerebra: 用于多模态痴呆表征与风险评估的多学科 AI 委员会
- 在虚拟临床环境中进化诊断智能体
- MDAgents: 用于医疗决策的 LLM 自适应协作
- Zodiac: 用于多智能体诊断的心脏病专家级 LLM 框架
- MADD: 多智能体药物发现乐团
- SciAgent: 用于通用科学推理的统一多智能体系统
数据与机器学习
- LAMBDA: A Large Model Based Data Agent
- Agentic Retrieval-Augmented Generation for Time Series Analysis
- Multi-Agent Collaborative Data Selection for Efficient LLM Pretraining
- AutoML-Agent: A Multi-Agent LLM Framework for Full-Pipeline AutoML
- AutoKaggle: A Multi-Agent Framework for Autonomous Data Science Competitions
- DataLab: A Unified Platform for LLM-Powered Business Intelligence
安全
- BreachSeek: A Multi-Agent Automated Penetration Tester
- Got a Secret? LLM Agents Can't Keep It: Evaluating Privacy in Multi-Agent Systems
多模态
- Mora: 通过多智能体框架实现通用视频生成
- Mobile-Agent-v2: 具备高效导航能力的移动设备操作助手
- Optimus-1: 混合多模态记忆赋能的智能体在长时程任务中表现卓越
- Soap2Soap: 通过多智能体协作进行长电影视频重制
- Gamma-World: 超越双玩家的生成式多智能体世界建模
- 迈向可验证的多模态深度研究:用于交错报告生成的多智能体框架
- MP5: 通过主动感知在 Minecraft 中构建的多模态开放式具身系统
- PC-Agent: 用于 PC 上复杂任务自动化的分层多智能体框架
- 通过向同行小组学习改进大型视觉语言模型
- PixelCraft: 用于结构化图像高保真视觉推理的多智能体系统
- UFO: 专注于 Windows 操作系统交互的 UI 智能体
- 基于大语言模型用于知识型视觉问答的多智能体
- 由 LLM 从并行 TextWorld 中训练的具身多模态智能体
- 两个头比一个好:用于人机交互的协作 LLM 具身智能体
- LongVideoAgent: 长视频多智能体推理
其他领域
- 结合语言模型与战略推理实现人类水平的《外交》游戏水平
- CulturePark:提升大语言模型的跨文化理解能力
- 超越人类翻译:多智能体协作翻译超长文学文本
- FanCric:用于构建梦幻十一人板球队伍的多智能体框架
- 大语言模型能掌握法律理论吗?通过多智能体协作增强法律推理
- SQL-of-Thought:带有引导式错误纠正的多智能体文本转 SQL
- CoMet:多智能体语言游戏中隐喻驱动的隐蔽通信
- Richelieu:用于 AI 外交的自进化基于 LLM 的智能体
- 用于参与式城市规划的大语言模型
- 大语言模型赋能的参与式城市规划
- Agents on the Bench:基于大语言模型的多智能体框架用于可信数字司法
- AgentCourt:模拟法庭与对抗性可进化律师智能体
- MiniFed:整合基于 LLM 的智能体工作流以模拟 FOMC 会议
- TRIZ Agents:基于 TRIZ 创新的多智能体 LLM 方法
- 基于大语言模型的多智能体自动驾驶系统:近期进展综述
- KoMA:基于大语言模型的自动驾驶知识驱动多智能体框架
- 多智能体对话式推荐系统
- 增强超市机器人交互:一种处理多样化客户意图的多层级 LLM 对话界面
- 大语言模型在解决多智能体集群问题中面临的挑战
- 基于大语言模型的可扩展多机器人协作:集中式还是去中心化系统?
- MALMM:用于零样本机器人操作的多智能体大语言模型
- ControlAgent:通过 LLM 智能体与领域专业知识的新颖集成实现控制系统设计的自动化
- AgenticPay:用于买卖双方交易的多智能体 LLM 谈判系统
评估与模型改进
- 硅基群体的智慧:LLM 集成预测能力与人类群体准确率相当
- Chatbot Arena:一个基于人类偏好评估 LLM 的开放平台
- 更多的 LLM 调用就是你所需要的一切吗?迈向复合推理系统的扩展定律
- 模型合并配方的进化优化
- 用陪审团取代法官:使用多样化模型面板评估 LLM 生成内容
- 宪法式 AI:来自 AI 反馈的无害性
- 关于使用弱 LLM 评估强 LLM 的可扩展监督
- ChatEval:通过多智能体辩论实现更好的基于 LLM 的评估器
- RouteLLM:一个用于成本效益 LLM 路由的开源框架
- Agent-as-a-Judge:使用智能体评估智能体
- 通过迭代辩论对大语言模型进行对抗性多智能体评估
- MALT:通过多智能体 LLM 训练改进推理
- 为什么多智能体 LLM 系统会失败?
- 使用多智能体思维树验证器智能体改进 LLM 推理
- 你的智能体也在变老:部署系统的智能体生命周期工程
- 共享更多,搜索更少:用于高效测试时扩展的协作并行思维
- ResearchMath-14K:通过智能体扩展研究级数学
- 用于多智能体推理和心智理论的 Decrypto 基准测试
- Chain-of-Agents: 通过多智能体蒸馏与智能体强化学习构建端到端智能体基础模型
- Probe by Gaming: 基于游戏的评估大语言模型概念知识的基准测试
- 面向大语言模型的智能体强化学习全景:一项综述
- 基于协作角色注入的大语言模型智能体进行立场检测
- 利用多智能体大语言模型(LLMs)进行内容知识识别
- 为何使用大语言模型解决多智能体路径规划问题尚未成功
- 多智能体大语言模型系统的可靠决策制定
- Collab-Overcooked: 将大语言模型作为协作智能体进行基准测试与评估
- AutoDefense: 针对越狱攻击的多智能体大语言模型防御
- AlignUSER: 通过世界模型实现人类对齐的大语言模型智能体,用于推荐系统评估
- 超越离线 A/B 测试:用于推荐系统评估的上下文感知智能体模拟
- PerceptUI: 作为人类对齐的合成用户的大语言模型智能体,用于 UI/UX 评估
社会模拟与智能体社会
- TwinMarket: 面向金融市场的可扩展行为与社会模拟
- Generative Agents: 人类行为的交互式模拟体
- SOTOPIA-π: 社会智能语言代理的交互式学习
- Scaling Instructable Agents Across Many Simulated Worlds
- Scaling Synthetic Data Creation with 1,000,000,000 Personas
- Cooperate or Collapse: LLM 代理社会中可持续合作的涌现
- From Text to Life: 论人工生命与大语言模型之间的相互关系
- Mindstorms in Natural Language-Based Societies of Mind
- Agents' Room: 通过多步协作进行叙事生成
- GenSim: 基于大语言模型代理的通用社会模拟平台
- Large Language Models can Achieve Social Balance
- Cultural Evolution of Cooperation among LLM Agents
- SDPO: 面向社会代理的片段级直接偏好优化
- AgentSociety: LLM 驱动的生成式代理的大规模模拟
- OASIS: 百万代理的开放代理社会交互模拟
- LLM-Based Social Simulations Require a Boundary
- Social World Models
- Simulating Human-like Daily Activities with Desire-driven Autonomy
- Implicit Behavioral Alignment of Language Agents in High-Stakes Crowd Simulations
- 大于其部分之和:探索多智能体的社会影响力
- 多智能体是社会群体:探究人机交互中多智能体的社会影响力
- 数字红皇后:基于 LLM 的核心战争对抗性程序进化
- 分布式 AGI 安全:对抗压力下的多智能体系统治理权衡
- Agentopia:智能体社会中的长期生活模拟与学习
- CitySim:利用大规模 LLM 驱动的智能体模拟建模城市行为与城市动态
- 从经济智能体到智能体经济:经济世界模型的体系蓝图
- **基础模型博弈论揭示了通过相似性推理实现理性合作的新路径 Link
工作流、架构与智能体设计
- AllHands: 基于大语言模型的大规模逐字反馈问答
- AgentInstruct: 迈向基于智能体流程的生成式教学
- SciAgents: 通过多智能体智能图推理自动化科学发现
- Minstrel: 面向非AI专家的多智能体协同结构化提示生成
- AFlow: 自动化智能体工作流生成
- Agents Thinking Fast and Slow: 一种说话者-推理者架构
- DynaSaur: 超越预定义动作的大语言智能体
- LLMs as Method Actors: 一种提示工程与架构模型
- Proposer-Agent-Evaluator(PAE): 基础模型互联网智能体的自主技能发现
- Automated Design of Agentic Systems: 智能体系统的自动化设计
- The Fellowship of the LLMs: 用于合成偏好优化的多智能体工作流
- Multi-agent Architecture Search via Agentic Supernet: 通过智能体超网进行多智能体架构搜索
- Talk Structurally, Act Hierarchically: 一种LLM多智能体系统的协作框架
- When One LLM Drools, Multi-LLM Collaboration Rules: 当一个LLM流口水时,多LLM协作规则
- Enhancing Reasoning with Collaboration and Memory: 通过协作与记忆增强推理
- Diffusion Augmented Agents: 一种用于高效探索与迁移学习的框架
- Model Swarms: 通过群体智能协作搜索适应LLM专家
- MDocAgent: 一种用于文档理解的多模态多智能体框架
- Recon-Act:一种通过网络侦察、工具生成和任务执行实现自我进化的多智能体浏览器使用系统
- 构建你的个性化研究小组:用于持续和交互式科学自动化的多智能体框架
- 人类-智能体协作的论文到页面制作,成本低于 0.1 美元
- 搜索自博弈:在无监督下推动智能体能力的前沿
- 从沟通到完成:利用智能多智能体通信建模协作工作流
- ComProScanner:一种基于多智能体的框架,用于从科学文献中提取组合属性结构化数据
- LLM 投票:人类选择与 AI 集体决策
- 通过协作语言智能体进行多约束规划
- 一种选举方法以多样化基于 LLM 的多智能体集体决策
- 交互式投机规划:通过系统与人机界面的协同设计提升智能体效率
- 从最优控制视角看提示工程
- 用于零样本命名实体识别的协作多智能体框架
- 多脑优于单脑:基于 LLM 的多智能体系统改进科学创意生成
- PlotGen:通过多模态反馈实现基于多智能体 LLM 的科学数据可视化
- 基于 LLM 的多智能体框架增强金融市场异常检测
科学
- GenoTEX: 用于自动化基因表达数据分析的 LLM 智能体基准
- GenoMAS: 通过代码驱动的基因表达分析实现科学发现的多智能体框架
- aiXiv: 由 AI 科学家生成的下一代科学发现开放获取生态系统
- ScientistOne: 通过证据链迈向人类水平的自主研究
- AutoScientists: 用于长期科学实验的自组织智能体团队
- The AI Scientist: 世界上首个用于自动化科学研究的 AI 系统
- 物理科学中的深度研究:一个多智能体框架与综合基准
对齐
强化学习
- MAPoRL: 基于强化学习的协作大语言模型多智能体后协同训练
- YOLO-MARL: 多智能体强化学习只需一次 LLM
- 基于 LLM 的多智能体强化学习:当前与未来方向
- 用于推理的协作多智能体测试时强化学习
- 通过过程奖励扩展多智能体系统
综述
- 基于大语言模型的多智能体:进展与挑战综述
- 基于 LLM 的多智能体系统综述:工作流、基础设施与挑战
- 多智能体协作机制:LLM 综述
- 基于 LLM 的多智能体系统综述:应用领域的最新进展与新前沿
- 基于大语言模型的自主智能体综述
- 大语言模型:综述
- LLM 多智能体系统:挑战与开放问题
- 跨多种应用的多智能体协调:综述
- 基于 LLM 的多智能体系统:技术与商业视角
- 小型 LLM 是薄弱的工具学习者:一个多 LLM 智能体
Others
Finance
Agents for Research
Training
引用
在 arxiv_bibtex.bib 文件中,你可以找到本仓库中所有论文的 bibtex 引用。
引用本列表
如果你在研究中发现此资源有用,请按照以下方式引用:
BibTeX:
@misc{gomez2024awesome,
author = {Gomez, Kye},
title = {Awesome Multi-Agent Papers: A Compilation of the Best Multi-Agent Research},
year = {2024},
publisher = {GitHub},
journal = {GitHub Repository},
howpublished = {\url{https://github.com/kyegomez/awesome-multi-agent-papers}},
note = {Maintained by the Swarms Team. Contact: kye@swarms.world}
}
APA:
Gomez, K. (2024). Awesome Multi-Agent Papers: A Compilation of the Best Multi-Agent Research. GitHub. https://github.com/kyegomez/awesome-multi-agent-papers
MLA:
Gomez, Kye. "Awesome Multi-Agent Papers: A Compilation of the Best Multi-Agent Research." GitHub, 2024, https://github.com/kyegomez/awesome-multi-agent-papers.
如有疑问或合作意向,请联系:kye@swarms.world
贡献
有一篇多智能体论文不在列表中?我们欢迎你的贡献!请提交一个 Pull Request (PR) 来添加新论文,帮助我们维护这一面向多智能体研究社区的全面且最新的资源。通过贡献,你使其他人——尤其是新手——能够在一个集中的存储库中获取最新的研究成果。感谢帮助社区成长!
许可证
本项目采用 Apache License 2.0 授权。