AgentGPT
浏览器里组装和部署 autonomous AI agent 的开源平台,无需代码即可创建多步骤任务规划 AI 助手
加载项目详情…
本应用为开源项目,仅供学习研究,请遵守其开源协议。
浏览器里组装和部署 autonomous AI agent 的开源平台,无需代码即可创建多步骤任务规划 AI 助手
加载项目详情…
本应用为开源项目,仅供学习研究,请遵守其开源协议。
2023年4月,一个名为 AgentGPT 的开源项目在 GitHub 悄然上线。没有任何宣传预算,仅靠技术社区自发传播,两周内便斩获了超过 36,000 颗星标(stars)、日活用户突破 10 万,上线一周便霸榜 GitHub Trending。这不是偶然——它的创始团队 reworkd 由两位年轻开发者组成,他们的愿景简单而大胆:让任何人都能在浏览器里"组装"属于自己的 AI agent,而不需要写一行代码。

图1:AgentGPT 项目 banner,Next.js 前端 + 品牌视觉设计
AgentGPT 的诞生并非凭空而来。它站在巨人的肩膀上——项目直接集成了 LangChain(^0.0.295 版本,对应彼时 LangChain 的早期架构),引用了 BabyAGI、AutoGPT 等 autonomous agent 领域的前沿探索。但 AgentGPT 的创新在于:将 CLI 工具的 agent 能力平移到了 Web UI。
在此之前,AutoGPT 和 BabyAGI 都运行在终端里,用户需要懂 Python、配置环境变量、理解 agent loop(规划→执行→反思→再规划)的概念才能上手。这道技术门槛让大量对 AI 感兴趣的普通用户望而却步。AgentGPT 创始人敏锐地捕捉到了这个 gap,用 Next.js 构建了一个现代化前端,让 agent 的配置过程变成了填写表单、点击按钮的傻瓜式操作。
从技术演进看,AgentGPT 的发展经历了三个阶段:
有趣的是,2024年 TechCrunch 报道称 reworkd 团队已悄然转型,将 AgentGPT 的核心技术应用于**网页数据抓取(web scraping)**赛道,创办了新公司并获得了 Paul Graham、Nat Friedman、Daniel Gross 等顶级投资人的投资。这个转身本身,恰恰证明了 AgentGPT 背后 agent 技术的普适性和商业价值。
我们可以把 AgentGPT 想象成一个能力超强但需要"教练指挥"的实习生。
这位"实习生"(即 agent)具备以下能力:
而 AgentGPT 就是这个实习生的"指挥台"——你设定目标(name your agent),给它起个名字(比如"市场调研小助手"),描述你的目标(describe your goal),剩下的由 agent 自动完成。
AgentGPT 采用成熟的前后端分离架构,技术选型兼具工程严谨性和开发效率。
前端采用 Next.js 14+(pages 架构)、TypeScript 全栈类型安全、TailwindCSS 快速样式开发。项目使用 Prisma 作为 ORM,前端和后端通过 Prisma schema 共享数据模型定义,类型一致性有保障。Dockerfile 支持多阶段构建,生产镜像体积优化。
后端是标准的 FastAPI 微服务,核心依赖:
frontend (Next.js) → 端口 3000
platform (FastAPI) → 端口 8000
agentgpt_db (MySQL 8) → 端口 3307
三服务通过 docker-compose 编排,MySQL 提供持久化存储,FastAPI 处理 agent 逻辑,Next.js 提供交互界面。数据流向:用户操作 → Next.js → FastAPI (LangChain agent) → OpenAI API → 搜索/工具调用 → MySQL 存储结果 → 返回前端展示。
用户只需三步:命名、描述目标、执行。agent 自动规划、分解、执行任务链,不需要写代码,不需要懂 AI。
agent 集成了丰富的外部工具:搜索引擎(Serper API)实时获取互联网信息、代码执行(Replicate)调用云端 AI 模型、知识库(Pinecone)支持 RAG 检索、文件操作支持本地文件读写(CLI 版本)。
与纯内存运行的 AutoGPT 不同,AgentGPT 将任务状态持久化到 MySQL,支持断点恢复(运行中断后可继续)、历史记录(查看完整思考链和执行轨迹)、并发多 agent(同时运行多个不同目标的 agent)。
项目预留了工具注册机制,开发者可以添加自定义工具,通过 LangChain 的 tool calling 接口无缝接入 agent 能力。
项目提供了完整的 docker-compose.yml,配置了三服务一键启动:
git clone https://github.com/reworkd/AgentGPT
cd AgentGPT
cp .env.example .env # 填写 API Key
docker-compose up -d
硬件要求:无需 GPU,普通 4GB RAM 的服务器即可运行(agent 推理依赖 OpenAI API,不占用本地算力)。磁盘约 2GB(含 Docker 镜像)。约 30 分钟可完成部署。
直接访问 https://agentgpt.reworkd.ai 在线体验。官方托管版本对 API 调用有限流,自建版本无此限制。
AgentGPT 并非完美,了解其局限性有助于做出合理预期:
agent 的核心能力取决于底层 GPT 模型。GPT-3.5 的推理能力有限,面对复杂多步骤任务时容易出现"规划迷失"(planning drift)——agent 会不断产生新子任务,最终陷入死循环或偏离原始目标。GPT-4 效果显著更好,但成本也更高。
agent 具备联网搜索和工具调用能力,可能执行恶意网页中的 prompt injection 攻击。AgentGPT 在工具层做了基础过滤,但没有完美的安全护栏,在自动化生产环境中使用需要谨慎。
虽然本地不耗 GPU,但每次 agent 执行都会调用 OpenAI API(约 $0.002-0.03/千 token),一个复杂任务可能消耗数十次 API 调用。对于需要大量运行 agent 的场景,成本管理是一大挑战。
项目直接依赖 LangChain ^0.0.295,这是一个快速迭代的库。随着 LangChain 架构的演进(如 0.1.0 后的 breaking changes),维护升级可能面临兼容性问题。
AgentGPT 的爆火折射出 2023 年 AI 领域的一个核心趋势:从"单次问答"到"自主执行"的范式转移。
AgentGPT 的最大贡献在于民主化:它让 agent 技术从极客圈走向了更广泛的用户群体。它的爆火也反向推动了 OpenAI、LangChain 等底层框架的完善,形成了"应用层倒逼基础设施"的良性循环。
从 reworkd 团队的转型可以看到,自主 agent 的真正商业价值很可能不在 toC 的"通用助手",而在 toB 的"垂直场景自动化"——网页数据抓取、代码审查自动化、研究报告生成……这些场景有一个共同点:有明确目标、有可量化结果、有付费意愿。
AgentGPT 是一个处于 AI agent 发展早期阶段的标志性项目。它以极低的使用门槛,将 autonomous agent 的强大能力带到了普通用户面前。尽管存在安全、成本、企业级能力等方面的局限,但它的开源精神和快速迭代能力值得肯定。对于希望了解或体验 AI agent 的开发者、研究者和爱好者,AgentGPT 依然是目前最值得尝试的入门级项目之一。
适合人群:AI 爱好者(体验 autonomous agent 能力)、开发者(基于 LangChain 构建自己的 agent)、研究者(参考 agent loop 实现)。不适合:对数据安全有严格要求的生产环境、算力受限的离线场景、缺乏 API 成本预算的个人用户。