SimpleEnglish
让大模型写出空客/波音手册级别无歧义技术文档的 AI Agent Skill,72.9% 减少 STE 违规率。
加载项目详情…
本应用为开源项目,仅供学习研究,请遵守其开源协议。
让大模型写出空客/波音手册级别无歧义技术文档的 AI Agent Skill,72.9% 减少 STE 违规率。
加载项目详情…
本应用为开源项目,仅供学习研究,请遵守其开源协议。
凌晨两点,波音 737 客舱里警报灯亮了。地勤人员翻开维护手册,第 17 页写着这样一段话:
"Occasionally, the system may exhibit intermittent behavior where the sensor feedback loop fails to properly synchronize with the thermal management subsystem, potentially leading to suboptimal performance outcomes."
他揉着眼睛又读了三遍,还是没搞懂这玩意儿到底要他干什么。
这就是 AI 文档滑铁卢。当 Claude、GPT-4 这些大模型被要求写技术文档时,它们输出的东西——从句套从句、"robust"、"seamlessly" 一把、"it should be noted that" 开头的废话段落——连英语母语的工程师都要反复猜意思,更别说非英语母语的地勤、海员、医疗设备操作员了。
AminBlg/SimpleEnglish 解决的就是这个问题:它是一套 AI Agent 的 Skill,让大模型写出来的文档像空客/波音维护手册那样——每个句子只有一个意思,任何人读都不会误解。
故事要从四十一年前说起。1983 年,航空领域面临一个严峻问题:维修手册错误导致的事故居高不下。一个英国工程师写"check the valve",一个德国工程师理解成"inspect"(目视检查),一个日本工程师理解成"test"(功能测试)——三人做了三件不同的事。
为此,ASD(国际航空质量标准化组织) 开发了 ASD-STE100 Simplified Technical English(简化技术英语)——一套受控语言规范,专门规定技术文档怎么写:每个词只有一个意思,句子不超过 20 个词(操作指令)或 25 个词(描述性文字),只用简单时态,禁止"should"、"would"这类模糊情态动词……共 53 条规则,每条都有编号。
这套标准至今仍在使用:A320 维护手册、空客培训教材、欧洲防务局技术文档,全都用 STE 编写。它的目的从一开始就不是让文字漂亮,而是让文字不可能被误读。
而 SimpleEnglish 项目的作者 AminBlg 做的事,就是把这 53 条航空航天规范,转写成一套 AI Agent 的系统提示词(System Prompt)。模型在写作时遵循这套规则,输出的技术文档自动符合 STE 标准——飞机维修工能读懂,AI 废话自动消失。
类比一下:如果普通大模型输出的是"文学青年写的说明书",SimpleEnglish 就是强迫它切换成"老工程师写的交接文档"模式。
核心原理很直接:
npx skills add AminBlg/SimpleEnglish,自动适配 Claude Code、Cursor、Copilot、Codex、Gemini CLI 等主流 AI 开发工具实际效果有多显著? 作者在 6 个 Claude 模型 × 8 个写作任务(96 次生成)上做了对照实验,用正则表达式检测 STE 违规率,结果:
| 指标 | 无 Skill(基准) | 有 Skill | 变化 |
|---|---|---|---|
| 每 100 词违规数 | 2.28(平均) | 0.42(平均) | ↓72.9% |
| 平均句长 | 11.2 词 | 9.7 词 | 更短 |
| 输出 Token | 全部减少 | — | ↓10-15% |
所有 6 个 Claude 模型(从 Opus 到 Sonnet)全部胜出,没有例外。
作为纯 Prompt Skill 项目,SimpleEnglish 的安装和使用没有任何技术门槛:
# 方式一:npx 一键安装(支持所有主流 Agent 工具)
npx skills add AminBlg/SimpleEnglish
# 方式二:想先试试效果
npx skills use AminBlg/SimpleEnglish@simple-english
# 方式三:没有 SKILL.md 支持的 Agent
# 复制 prompts/system-prompt.md 的内容到 AGENTS.md 或系统提示词
对于 Claude.ai(付费版):下载 SKILL.md → Settings → Customize → Skills → Upload → 开启。对于 ChatGPT:将 prompts/system-prompt.md 内容粘贴到 Custom Instructions 中。
没有图形界面,不需要 GPU,不需要服务器——就是一段 Prompt,但它改变的是模型输出的本质。
SimpleEnglish 有明确的边界:不适用营销文案、品牌稿件、博客语气。STE 标准的目的就是让文字"平"——禁止形容词、禁止修辞、禁止任何让文字"好听"但不精确的东西。写产品官网用这个规范,等于自废武功。
此外,虽然评测显示违规率降低 72.9%,但正则检测无法覆盖所有 STE 违规类型(被动语态、词性错误等无法被 regex 捕获)。作者也坦承:没有任何工具能保证 100% STE 合规,包括这个项目。输出仍需人工审查。
SimpleEnglish 的出现揭示了一个趋势:当 AI 能生成内容时,"如何生成符合规范的内容"就成了独立的产品赛道。它不是微调,不是 RAG,而是一个可以在任何 Agent 上复用的 Prompt Skill——开发成本极低,但解决了文档质量控制的真实痛点。
随着 AI 生成内容(AIGC)在技术文档、医疗说明、法规遵从文件中的渗透,内容合规性将变成刚需。SimpleEnglish 代表的方向:用经过验证的行业标准(航空航天级规范)驯服大模型的"话痨本能",比让用户自己写一堆 Few-shot 示例要优雅得多。
数据来源:项目 GitHub 仓库(1364 Stars),评测报告 evals/results/RESULTS.md,ASD-STE100 官网。