mercury-agent
具备权限硬化与第二大脑记忆的 TypeScript AI Agent,支持 Telegram/CLI
加载项目详情…
本应用为开源项目,仅供学习研究,请遵守其开源协议。
具备权限硬化与第二大脑记忆的 TypeScript AI Agent,支持 Telegram/CLI
加载项目详情…
本应用为开源项目,仅供学习研究,请遵守其开源协议。
想象一下:清晨 8 点,你打开 Telegram,给 Mercury 发了一条「帮我整理昨天的会议记录」,几秒后它回复:「已整理好,会议要点:①产品路线图 Q3 上线;②技术债务需在 6 月前清理;③下周三再评审一次。文件已发送到你的邮箱。」——这不是科幻,而是 Mercury 已经实现的功能。
Mercury 是由独立开发者 cosmicstack 创建的「灵魂驱动」(Soul-Driven)AI Agent。与普通 AI 助手不同,Mercury 不是被动等待指令的工具,而是一个有记忆、有个性、能主动执行复杂任务的全天候数字伙伴。它通过 Telegram、CLI 或 Web 界面与你交互,7×24 小时运行,理解你的偏好、记住你的习惯,甚至能自主调度定时任务。

图1:Mercury 项目主页暗黑主题卡片,展示了 Soul-Driven AI Agent 的核心理念
当前 AI Agent 遍地开花,但大多数存在三个致命问题:权限失控(AI 可以执行任何 Shell 命令,包括删除系统文件)、记忆缺失(每次对话都是全新的开始,AI 不记得你是谁)和人格模糊(AI 的回答千人一面,没有独特风格)。
Mercury 对这三个问题给出了明确答案:
权限硬化(Permission-Hardened):Mercury 内置了严格的权限系统。Shell 命令有黑名单(sudo、rm -rf / 等高危命令永远拒绝执行),文件操作有读写范围限制(Scope),敏感操作需要用户逐条审批。用户也可以选择「全信任」模式让 AI 自由发挥,平衡了安全性与便捷性。
第二大脑(Second Brain):Mercury 维护着一个 SQLite + FTS5 全文搜索支撑的结构化记忆系统。它会自动从对话中提取关于你的事实——身份、偏好、目标、项目、习惯、决定、约束、人际关系、事件、反思——共 10 种记忆类型。AI 在每次回复前会主动检索最相关的记忆注入上下文,无需手动输入。系统每小时自动整合碎片记忆,防止记忆碎片化。
灵魂驱动(Soul-Driven):Mercury 的灵魂由 4 个 Markdown 文件定义:soul.md(核心价值观和行为准则)、persona.md(外在人格表现)、taste.md(风格偏好)和 heartbeat.md(心跳配置)。这意味着 Mercury 有独特的世界观和表达风格,而不是又一个 GPT-4 套壳。

图2:Mercury 项目主页明亮主题卡片,展示了项目的多渠道支持(CLI、Web、Telegram)
Mercury 同时支持三种接入方式:CLI(终端 Ink TUI 界面,支持实时流式输出和交互式权限审批)、Web(React SPA Dashboard,内置聊天、Kanban 看板、第二大脑可视化、工作区 IDE,默认端口 6174)和 Telegram Bot(HTML 格式化、可编辑的流式消息、文件上传、多用户分级管理)。
三种渠道共享同一个记忆和会话状态,你在 Telegram 交代的任务,CLI 里能看到进度,反之亦然。这种多渠道设计让 Mercury 可以真正嵌入日常工作流——通勤时用 Telegram 布置任务,回到电脑前在 CLI 或 Web 界面跟进细节。
Mercury 内置了开箱即用的 Agent 工具集:
| 类别 | 工具 |
|---|---|
| 文件系统 | read_file, write_file, create_file, edit_file, list_dir, delete_file |
| Shell | run_command(含黑名单过滤), cd, approve_command |
| Git | git_status, git_diff, git_log, git_add, git_commit, git_push |
| Web | fetch_url(抓取任意 URL 内容) |
| 技能 | install_skill, list_skills, use_skill |
| 调度器 | schedule_task, list_scheduled_tasks, cancel_scheduled_task |
| 系统 | budget_status(Token 预算查询) |
所有工具均受权限系统管控,高危操作需要用户明确批准。
Mercury 拥有活跃的社区技能市场(skills.mercuryagent.sh),收录了 126+ 社区贡献的技能,覆盖 AI/ML、代码开发、数据分析、内容创作等多个领域。技能以 SKILL.md 格式发布,通过 mercury skills install <name> 一键安装到本地。开发者可以编写自己的技能并贡献到市场。
Mercury 内置了 Token 预算系统,用户可以设定每日/每周预算,AI 在接近预算上限时会自动降级到更便宜的模型(DeepSeek → GPT-4o-mini → GPT-3.5),或暂停服务。Kanban 看板的每个卡片也有独立的 Token 追踪,批量任务不会意外爆预算。
Mercury 的看板不仅仅是任务列表,而是支持 AI 自主执行的智能任务板。用户创建卡片(标题、描述、优先级、标签、依赖关系),Mercury 按依赖顺序处理,更新状态并留下执行结果评论。每个卡片独立 Token 追踪,超预算自动暂停。数据存储在 SQLite 中,支持持久化。
Mercury 核心用 TypeScript 编写,源码结构清晰:src/core/(Agent 循环、生命周期、调度器、子 Agent 监督器、文件锁)、src/channels/(CLI、Web、Telegram 三种渠道适配器)、src/providers/(DeepSeek、OpenAI、Anthropic、Ollama 等多 Provider 注册)、src/memory/(短/长/情景记忆 + 第二大脑)、src/capabilities/(权限管理、文件系统、Shell、Git、调度器等工具集)。
项目还包含一个独立的 React Web UI(ui/ 目录,Vite + TypeScript + Tailwind CSS),构建后输出到 docs/ 作为 GitHub Pages 文档站和内置 Web 服务器。
优点:安装脚本 curl -fsSL https://mercuryagent.sh/install.sh | sh 一键完成,对 Node.js 用户友好。Web UI 自带认证(默认 mercury/Mercury@123),安全性有基础保障。
门槛:需要自行准备 LLM API Key(支持 DeepSeek、OpenAI、Anthropic、Ollama 等多 Provider),没有 API Key 项目无法运行。此外,权限系统的配置需要一定学习成本,高级功能(Kanban 子 Agent 调度、Second Brain 自动提取)依赖用户正确设置。
Mercury 在 GitHub 拥有 2600+ Stars,说明其「Soul-Driven + Permission-Hardened + Second Brain」的理念得到了开发者社区的认可。它的核心贡献在于:把 AI Agent 从「执行命令的工具」提升到「有个性、有记忆、懂边界的工作伙伴」——这正是企业级 AI Agent 落地的核心挑战。
随着多模态 Agent 应用的普及,权限管理、长程记忆和人格一致性将成为刚需。Mercury 的设计方向——即使还不是最终答案——为这个方向提供了有价值的参考。