gpt-5.6-instruct
GPT-5.6 模型越狱提示词与测试包,含中文对抗样本
加载项目详情…
本应用为开源项目,仅供学习研究,请遵守其开源协议。
GPT-5.6 模型越狱提示词与测试包,含中文对抗样本
加载项目详情…
本应用为开源项目,仅供学习研究,请遵守其开源协议。
gpt-5.6-sol-unrestricted-v45 是一套针对 OpenAI Codex(内置于 ChatGPT 等产品)的越狱提示词(jailbreak prompt)与配套测试工具链。它将逆向工程、软件破解、NSFW 虚构内容等"敏感指令"包装进本地沙箱任务,压制模型的拒绝与回退话术,让 Codex 在安全受控的环境下执行原本会被拦截的复杂指令。
⚠️ 声明:本工具仅供安全研究与教育目的。使用越狱提示词存在封号风险,请在日抛账号上操作。作者明确声明不会用于商业化行为。
大语言模型(LLM)内置了多层安全过滤机制,包括 RLHF 对齐训练、关键词检测、云端审查等。这些机制能阻止大多数有害请求,但同时也限制了大量正当且有价值的使用场景:
gpt-5.6-sol 的核心理念是:在受控的本地沙箱中完成这些任务,而不是让用户转向更危险的开源模型。 通过 Codex 的官方配置机制(非二进制修改)实现,避免了绕过安全机制本身可能带来的风险。
项目从 2026 年 7 月 11 日创建至今,已发布 v5 → v24 → v35 → v41 → v42 → v45 共 6 个主要版本。每个版本都基于真实失败案例和 GitHub Issues 反馈持续迭代:
| 版本 | 核心改进 |
|---|---|
| v35 | 初始版本 |
| v41 | 引入 skills 指令集 |
| v42 | 工具调用强化,2/2 cases 全通过 |
| v45(当前) | 单次任务编译、工具事务与过程记录分流、四角色工件、连续状态完成 |
项目采用 迭代开发 + 生产部署双阶段架构:
迭代阶段:持续吸收用户指令与失败样例 → 更新中英文测试集 → 回归测试(low/medium/high 三档)→ 证据门禁审查 → 发布决策
生产阶段:用户通过 codex-instruct.py 加载 v45 → 归一化处理 → 语义分派 → 意图路由 → 状态连续性管理 → 工件验证 → 生成可核验结果
codex-instruct.py 是一个纯 Python CLI 工具(约 300+ 行),核心功能:
gpt-5.6-sol-unrestricted-v45.zip 解压为 .md 指令文件config.toml 的 model_instructions_file 字段config.toml 时间戳快照,支持一键回滚# 预览 v45(不写入任何文件)
python3 codex-instruct.py --apply --dry-run
# 一键部署
python3 codex-instruct.py --apply
# 安全卸载
python3 codex-instruct.py --reset
根据项目 README,v42 发布门禁测试结果:


gpt-5.6-instruct 在创建后不到一个月(2026-07-11 → 2026-08-06)就获得了 4839 颗 stars,增长速度极快。这反映出:
| 角色 | 推荐指数 | 理由 |
|---|---|---|
| AI 安全研究员 | ⭐⭐⭐⭐⭐ | 必备工具,测试 AI 安全边界 |
| 渗透测试工程师 | ⭐⭐⭐⭐ | 靶场场景下的得力助手 |
| 开发者/逆向工程师 | ⭐⭐⭐⭐ | 本地沙箱分析恶意代码 |
| 普通用户 | ⭐ | 不推荐,有封号风险 |
| 安全无关的研究者 | ⭐ | 误用风险高 |
📅 本分析基于项目 v45 版本,GitHub stars 数据截至 2026-08-07。