AutoHarness
AI Agent 行为治理中间件:六步治理管道 + Constitution YAML + 多 Ag
加载项目详情…
本应用为开源项目,仅供学习研究,请遵守其开源协议。
AI Agent 行为治理中间件:六步治理管道 + Constitution YAML + 多 Ag
加载项目详情…
本应用为开源项目,仅供学习研究,请遵守其开源协议。
图1:AutoHarness 官方 Logo
想象一下:你的 AI 编码助手刚刚花了 30 分钟写了一整套用户认证系统,却在最后一步——删除测试数据——时,执行了一条 DROP TABLE users CASCADE; 直接把生产数据库给清空了。不是因为它「学坏了」,而是因为它根本没有意识到自己在生产环境里。这就是 AI Agent 从「Demo Ready」到「真正可靠」之间那道巨大的鸿沟:模型会推理,但谁来治理它的行为?
AutoHarness(项目名「Aha」)就是为解决这个问题而生的。它给自己的定位是:AI Agent 的行为治理中间件(Behavioral Governance Middleware)。核心理念一句话:Agent = Model + Harness——模型负责推理,而治理框架负责兜底。
2026 年 3 月,清华大学和斯坦福大学各自发表了一篇论文,共同指向一个令人警醒的发现:在 AI Agent 系统中,编排代码(即 Harness)所产生的性能差异,比底层模型的差异还要大。
具体有多夸张?LangChain 只因为改了 Harness 基础设施,在 TerminalBench 2.0 上从 Top 30 开外直接冲到了第 5 名。同一套模型在完整 Harness 和精简 Harness 下,SWE-bench 得分都是 ~75%,但完整版多消耗了 14 倍的算力。更离谱的是,有个研究给 Agent 加了 Verifier 之后,性能反而下降了 8.4(OSWorld)。
这说明一个关键问题:不是模型越大越好,而是 Harness 越合理越好。 AutoHarness 正是踩在这个行业认知转折点上诞生的。
图2:AutoHarness 项目概览海报
AutoHarness 的治理逻辑通过一条六步管道(Pipeline)来实现,每一步都有明确的职责:
这套管道的独特之处在于多层次模式(Pipeline Modes):Core 模式仅 2 行代码即可集成,Standard 模式提供完整治理,Enhanced 模式包含风险模式匹配和 trace 诊断——可以根据场景灵活裁剪。
AutoHarness 内置了 MultiAgentGovernor 和 ModelRouter,支持多 Agent 协作场景,并能根据任务复杂度自动选择合适的模型层级(ModelTier):Haiku 用于简单查询,Pro 用于复杂推理,兼顾效果与成本。
AutoCompactor 和 microcompact 两套压缩机制,前者做全局上下文压缩,后者做局部增量压缩。压缩策略支持多种模式(按 Token 比例、按消息条数、按语义相关性),确保长对话场景下 Agent 始终在 Token 预算内运行。
代码中包含 DecoyToolGenerator,可以动态生成诱饵工具并注入工具注册表。当检测到某个工具调用符合蒸馏特征时,自动标记并阻断——这是业界少有的专门针对模型爬取攻击的防护机制。
内置 detect_frustration() 函数,通过对话历史分析用户或 Agent 的挫败感级别(FrustrationLevel),在检测到高挫败感时触发降级策略或人工介入提示。这是一个有趣的人文关怀设计,体现了「不只是管住 Agent,也要理解 Agent」的产品哲学。
安装只需一行命令:
pip install -e .
集成到现有 Agent 也只需要 2 行代码:
from autoharness import AutoHarness
harness = AutoHarness(constitution_path="constitution.yaml")
AutoHarness 还提供了 GitHub Action——autoharness/auto-harness-check,可以在 CI 流程中自动验证 Agent 的工具调用是否符合治理规则,输出一份 JSONL 格式的审计报告。这是目前市面上少见的「将 Agent 治理集成到 GitOps 流程」的方案。
AutoHarness 目前版本为 v0.1.1(Alpha),这意味着:
AutoHarness 的出现并非偶然。2026 年 3 月,学术界和工业界同时将目光聚焦在 Harness Engineering 上:清华的 Natural-Language Agent Harnesses、斯坦福的 Meta-Harness,以及 Anthropic 发布的《Effective Harnesses for Long-Running Agents》,共同构成了这个新兴领域的学术支柱。
AutoHarness 的核心贡献在于将学术前沿快速工程化落地:它把复杂的治理策略抽象为 YAML 配置,把六步管道封装为可插拔模块,把多 Agent 编排和成本追踪做进了一个 MIT 协议的开源项目里。这意味着任何团队——无论大小——都可以站在这个起点上,构建自己专属的 Agent 治理体系。
开源 958 个测试用例通过率、全面的类型注解(mypy strict)、多语言文档(简体中文、日语、韩语、西班牙语等 8 种语言),这些细节都在说明:AutoHarness 不仅仅是一个实验性项目,而是一个认真对待工程质量的社区级项目。
如果你正在构建 AI Agent 产品,或者在评估如何让现有的 Agent 系统更可靠、更安全、更可观测,AutoHarness 值得放进你的技术选型清单里细细研究。