agentUniverse
蚂蚁集团开源的多 Agent 框架,PEER/DOE 协作模式让 AI 智能体像团队一样分工协作
加载项目详情…
本应用为开源项目,仅供学习研究,请遵守其开源协议。
蚂蚁集团开源的多 Agent 框架,PEER/DOE 协作模式让 AI 智能体像团队一样分工协作
加载项目详情…
本应用为开源项目,仅供学习研究,请遵守其开源协议。
想象一下这样的场景:一家银行的智能客服系统,需要同时调用三个 AI 智能体——一个负责核验用户身份,一个负责查询账户流水,还有一个负责生成风险评估报告。三个智能体之间如何通信?任务如何分发?结果如何汇总?如果这三个 Agent 来自不同的技术供应商,系统该如何整合?
这就是 agentUniverse 要解决的问题。
agentUniverse 起源于蚂蚁集团的真实金融业务实践,是蚂蚁集团在多年内部沉淀后,于 2024 年正式开源的多 Agent 协作框架。它的核心目标只有一个:让开发者不需要深入理解 LangChain、AutoGen 等底层框架的复杂实现,也能构建出能够协同工作、解决复杂问题的大型语言模型应用。
上线不到两年,GitHub 斩获 2,269 Stars,成为国内热度最高的多 Agent 框架之一。它的崛起,既是国内大模型生态从"单点突破"走向"系统集成"的缩影,也代表了企业级 AI 应用从 Demo 走向生产的关键路径。

图1:agentUniverse 框架架构图 — 展示了 Agent、工具、知识库之间的协同关系
在 agentUniverse 诞生之前,蚂蚁集团的 AI 研发团队面临着一个经典困境:他们已经积累了数十个不同场景的 AI 智能体——客服 Agent、风控 Agent、信贷 Agent、理财 Agent——但这些 Agent 各自独立,无法协作。每当需要跨场景任务时,工程师们只能手写胶水代码,让一个 Agent 的输出手动传递给下一个 Agent。
这种方式有三个显著问题:
第一,扩展性差。 新增一个 Agent 需要修改大量胶水代码,每次改动都像在雷区里走路。
第二,责任边界模糊。 当一个复杂任务被分解给多个 Agent 时,谁负责规划整体流程?谁负责汇总结果?谁负责错误兜底?这些问题没有标准答案,导致系统行为难以预测。
第三,领域知识难以复用。 金融业务有大量专属的经验规则(比如"异地登录需要二次验证"、"单笔转账超过 5 万需要主管审批"),这些规则散落在各个 Agent 的代码里,无法被其他 Agent 复用。
agentUniverse 的核心设计哲学,就是用协同模式(Pattern) 来解决这三个问题。它不只是一个"让 Agent 更容易创建"的工具,更是一个"让 Agent 学会协作"的框架。
agentUniverse 框架内置了两套经过真实业务验证的多 Agent 协作模式,这也是它区别于其他框架的核心差异化能力。
PEER 是 Plan(规划)、Execute(执行)、Express(表达)、Review(评价)四个 Agent 的缩写。这四个 Agent 构成一个完整的"任务处理流水线":
这套模式的精妙之处在于:它把一个"大而全"的 Agent 拆成了四个"小而专"的 Agent,每个 Agent 只需要做好自己的本职工作。通过评价反馈机制,系统能够在执行过程中不断修正方向,提升推理分析类任务的表现。
典型应用场景包括:行业分析报告生成(Plan 拆解研究框架 → Execute 搜集数据 → Express 生成报告 → Review 检查逻辑完整性)和复杂事件解读(Plan 分解事件要素 → Execute 查询相关资料 → Express 输出解读 → Review 验证信息准确性)。

图2:PEER 模式四阶段执行示意
DOE 是 Data-fining(数据精制)、Opinion-inject(观点注入)、Express(表达)三个 Agent 的组合。这个模式专门针对"数据密集、高计算精度、需要融合专家观点"的任务——典型的场景就是财务报告自动生成。
在财务报表生成场景中,Data-fining Agent 负责从多个数据源提取原始财务数据,并进行清洗、转换、计算财务指标;Opinion-inject Agent 负责根据财务数据的异常值或趋势变化,从知识库中检索相关专家观点或行业基准数据,注入到报告中;Express Agent 则负责将数据和观点整合成结构化的报告文本,并按照不同受众(投资者、监管机构、内部管理层)调整表达风格。
agentUniverse 并不绑定某一个特定的大模型。通过简单的配置文件,开发者可以自由切换底层 LLM 提供商。目前框架已原生支持:
这种多模型支持让企业可以在不同业务场景下选择性价比最优的模型,也便于在国产化替代场景中灵活切换。
从代码结构来看,agentUniverse 并不是从零开发,而是在 LangChain 的基础上构建了一套面向企业级应用的扩展层。这种"站在巨人肩膀上"的策略让框架能够快速吸收 LangChain 成熟的组件生态,同时避免重复造轮子。
agentUniverse 分为四个主要 Python 包:
agentuniverse(核心框架):包含 Agent 抽象层(agent)、LLM 管理层(llm)、工作流引擎(workflow)和知识库/向量检索组件。Agent 模块支持自定义 Action、Memory 和 Context,满足不同场景下的状态管理需求。
agentuniverse_connector(连接器):提供与外部工具和服务的连接能力,包括 Search(搜索)、API 调用等扩展接口。
agentuniverse_extension(扩展包):企业级扩展组件,如阿里云日志服务(aliyun-log-python-sdk)、Milvus 向量数据库集成。
agentuniverse_product(产品层):基于框架构建的具体产品,包含 Web Chat 界面、Agent 编辑器、Agent 追踪(Trace)等可视化工具。这个子包的存在说明 agentUniverse 不只是一个底层框架,也有面向终端用户的完整产品形态。

图3:agentUniverse 项目模块结构,展示了各子包之间的依赖关系
| 层级 | 技术选型 |
|---|---|
| 运行时 | Python 3.10+ |
| LLM 框架 | LangChain 0.1.20 + LangChain Core 0.1.52 + LangChain Community 0.0.38 |
| 向量数据库 | ChromaDB 0.4.24 |
| 数据库 ORM | SQLAlchemy 2.0.25 |
| Web 服务 | Flask 2.3.2 + Gunicorn 22.0.0 |
| 数据处理 | Pandas 2.2.2 + NumPy 1.26 + PyArrow 16.1 |
| 协议支持 | gRPC 1.63 + OpenTelemetry 分布式追踪 |
| 构建工具 | Poetry |
LangChain 的使用让 agentUniverse 能够享受 LangChain 社区活跃的工具生态(1000+ 工具),同时也意味着它继承了 LangChain 的 API 风格和局限性。开发者如果熟悉 LangChain,上手会非常快;如果不熟悉,则需要一定的学习曲线。
框架在代码质量方面有较高要求:使用 mypy 进行强类型检查(disallow_untyped_defs = True),使用 ruff 作为 linter,使用 pre-commit 钩子规范提交,使用 pytest + pytest-cov 管理测试。TypeScript 风格的类型注解要求意味着所有函数的参数和返回值都必须有明确类型,这在大型团队协作中能有效减少隐式 bug。
agentUniverse 的安装非常友好,核心框架可以通过 pip 一键部署:
pip install agentUniverse
框架本身是纯 Python 包,不需要 GPU,不依赖特殊硬件。一台 4GB 内存的服务器即可运行基础功能。
示例项目包含 Dockerfile:虽然核心框架没有提供官方的生产级容器化部署方案,但 examples/sample_standard_app/image_build/ 目录下提供了一个可参考的 Dockerfile,开发者可以基于此构建自己的镜像。对于需要完整 Web UI 的用户,agentuniverse_product 子包提供了基于 Flask 的前端界面,但需要额外配置。
整体部署难度为"简单",预估 5 分钟内可完成基础安装。如果需要构建包含向量数据库(如 Milvus)的完整知识检索系统,部署复杂度会相应增加。
agentUniverse 框架的实际应用价值不仅体现在代码层面,其配套的产品体系也值得关注。框架附带了一个完整的"画布式研发平台",提供:
Agent Chat 聊天界面:普通用户可以直接通过 Web 界面与部署好的 Agent 进行对话交互,界面简洁直观。
Agent Editor 编辑器:开发者可以在可视化编辑器中配置 Agent 的角色、工具、知识库和协同模式,无需手写 YAML 配置。
Agent Trace 追踪面板:当 Agent 执行复杂任务时,Trace 面板可以实时展示各个子 Agent 的调用链路、执行状态和中间输出,方便调试和问题排查。
这三个工具构成了一个从"开发"到"调试"到"使用"的完整闭环,使得 agentUniverse 不仅仅是一个程序员手里的框架,也是一个团队协作平台。
agentUniverse 的设计选择——深度依赖 LangChain——既是优势也是潜在风险。
优势在于可以快速借助 LangChain 生态的工具和组件,减少开发工作量。LangChain 每月更新,agentUniverse 也能从中受益。
风险在于版本耦合。pyproject.toml 中锁定了 LangChain 0.1.20 和 LangChain Core 0.1.52 的精确版本号,这意味着如果 LangChain 发布重大 breaking change,agentUniverse 的升级路径可能会面临挑战。当前 LangChain 已经发展到 0.2+ 和 0.3+ 版本,而 agentUniverse 仍在使用 0.1.x 系列,存在一定的版本债务。
此外,虽然框架提供了 PEER 和 DOE 两种协作模式,但实际开箱即用的模式数量有限,更多复杂协作场景(如多 Agent 竞争、辩论、投票)还需要开发者自行设计实现。
从行业视角来看,agentUniverse 的开源代表了三个重要趋势:
趋势一:大模型应用从"调用 API"走向"系统集成"。 单靠调用 GPT-4 已经无法满足企业级需求,多 Agent 协作才是 AI 应用落地的正确打开方式。
趋势二:AI 基础设施的国产化需求。 蚂蚁集团作为国内顶级互联网公司,将内部沉淀多年的框架开源,既是技术自信,也是抢占国产 AI 框架生态位的战略选择。
趋势三:协同模式(Pattern)将成为 AI 应用开发的新抽象。 就像面向对象编程中的设计模式一样,多 Agent 协作模式将会沉淀出一套可复用的最佳实践,agentUniverse 的 Pattern Factory 理念正是这一趋势的先行者。
凭借蚂蚁集团的业务背书、活跃的社区维护(95 个 open issues 说明关注度高)和清晰的版本规划,agentUniverse 有望成为国内企业构建多 Agent 系统的首选框架。如需深入了解,可以访问 GitHub 仓库或阅读官方用户指南手册(docs/guidebook/zh/)。
附:关键资源链接