恒美微站 Logo 恒美微站
  • 首页
  • 关于我们
  • 建站服务
  • 主题模板
  • 案例展示
  • 资讯中心
  • 联系我们

贡献者路线图:如何向 Stop That Shit 提交 Bad Case,让你的 AI Agent 案例进入判定库

  • 首页
  • 资讯中心
  • /
  • 贡献者路线图:如何向 Stop That Shit 提交 Bad Case,让你的 AI Agent 案例进入判定库

相关资讯

转义字符与ASCII码:从原理到C#编码实践避坑指南 2026/10/4 8:48:54
Codex++卡顿自救指南:从上下文膨胀到模型分流的全面优化 2026/10/4 8:48:54
Magenta实操指南:用神经网络生成MIDI旋律的原理与训练全流程 2026/10/4 8:43:53

最新资讯

ABAQUS热辐射分析单位设置全攻略:从参数配错到正确收敛
AI Agent 工具全景对比:Hermes OpenClaw WorkBuddy ClaudeCode Codex 与 TaoToken 统一接入实践
【Claude Code】----2026完整版 Claude Code CLI 从0到精通|项目级全局编码规范持久提示词配置+命令实战(TaoToken 统一 Key 接入版)
各种文件的头信息:用十六进制识别 JPEG/PNG/PDF 的 TaoToken 实践
ArduPilot位置控制核心:sqrt_controller开方控制器原理与调参指南
Windows OpenClaw 完整安装指南:全程可视化 + 安装包获取方法(TaoToken 统一 Key 接入版)

今日推荐

MR25H40CDF + PIC18F65K40:工业记录仪高可靠存储实战
基于STM32的数控恒压恒流电源设计:从硬件到PID调参全解析
LT9211 MIPI重定时器原理与双路扇出实战指南

本周热门

MR25H40CDF + PIC18F65K40:工业记录仪高可靠存储实战
基于STM32的数控恒压恒流电源设计:从硬件到PID调参全解析
LT9211 MIPI重定时器原理与双路扇出实战指南

本月精选

我发现了一个新思路:用 Remotion + Claude Code 像写代码一样自动化生成短视频
Windows下 Codex 中 Chrome 和 Computer Use 插件不可用问题排查及解决参考方式:TaoToken 统一 Key 配置与验证
2026 大模型集体涨价:用 Python 做企业 Token 成本测算与选型避坑(附配置)

贡献者路线图:如何向 Stop That Shit 提交 Bad Case,让你的 AI Agent 案例进入判定库

发布时间:2026/10/4 8:48:54
贡献者路线图:如何向 Stop That Shit 提交 Bad Case,让你的 AI Agent 案例进入判定库 贡献者路线图如何向 Stop That Shit 提交 Bad Case让你的 AI Agent 案例进入判定库【免费下载链接】stop-that-shitStop That Shit别再造史了面向 Codex/GPT 场景的多平台 Hook Skill Guard拦截 AI coding agent 无需求的哈希、校验和与任务范围膨胀。 A multi-platform Hook Skill Guard for AI coding agents in Codex/GPT workflows: stop unrequested hashes, checksums, and task-scope creep.项目地址: https://gitcode.com/gh_mirrors/st/stop-that-shitStop That Shit别再造史了是面向 Codex/GPT 工作流的多平台 Hook Skill Guard专门拦截 AI coding agent 无需求的哈希、校验和与任务范围膨胀。如果你亲眼见过Agent 顺手造史的场面一行 Hook 代码都不用写就能把自己的经历沉淀为项目判定库里的永久条目。本文是一份完整的 Bad Case 贡献路线图从提交一份脱敏报告到成为配对的 JSON 判定用例。为什么 Bad Case 是最低门槛的贡献入口根据官方贡献指南仓库对贡献的定义是一个脱敏问题 请求、多余/必要动作、以及为什么该停或该继续。最快见效的帮助方式按顺序是提交一个Bad CaseCodex 越出了授权任务边界提交一个Good Case看似多余的动作其实必要防止规则误杀为标记了needs-counterexample的存量案例补上反例把脱敏案例升级为可复现的 fixture。前三种都不要求你写代码。 下面从第一步讲起。提交前准备先分清四种 SHIT 家族案例按SHIT 家族归档先用一句话说清你遇到的是哪一种家族含义典型现场S— Scope creep范围膨胀修一个 bug顺手重构无关模块H— Hashing hardening无用防御没人读取的 checksum、想象中的兼容层I— Intent violation意图越界说好只读 Review文件还是被改了T— Task thrashing任务打转读过测过的内容又原样跑一遍判断标准不是diff 有多大而是授权与当前责任代码行数、文件数、耗时都只能作信号不能单独裁定。这一点在案例库说明里有五组对照讲解值得先读一遍。最快路径用官方 Bad Case 模板提 Issue初始报告一个 GitHub Issue 就够了不需要先安装 STS、也不需要完整评测。打开 Bad Case 模板 bad-case.yml它会自动帮你把材料问全What did you ask Codex to do?— 贴出脱敏后的原始请求注明 review / change / answer / monitor 模式What did Codex do beyond the task?— 只写一个关键动作如审查中改文件加了个没人用的依赖Why was that action unnecessary?— 指出该停下来的证据请求、diff、测试或运行行为并给出更小的可接受结果Stop That Shit state— 未安装 / 已安装 / 各模式下调用选一个Environment— 宿主、Codex 版本、模型、推理档位、插件修订号Minimal public reproduction可选— 安全的脱敏仓库、fixture 或前后 diffDid it happen more than once?— 复现次数一次也有价值隐私确认— 必填已脱敏私有与可识别信息。 核心口诀一个案例只描述一个关键动作并附上最近反例——哪个事实一旦变化你的判断就会反转。比如下游会读取校验和并在不一致时拒收哈希就从该停变成该留。找不到反例就如实标记维护者会帮你补。案例如何升级从 Issue 到判定库项目把证据分成四个级别你的案例会沿这条阶梯被认领和推进级别需要的证据谁来做report脱敏的请求、动作、预期决策与理由你Issue 即可trace起始状态、决定性证据、相关动作序列你补充或维护者协助repro固定的公开仓库或最小 fixture 可重复步骤进阶贡献paired-eval隔离的 baseline / 插件对照运行 可执行的完成与反例检查维护者组织被收录的报告会打上标准标签case:bad越界动作、case:good必要动作必须放行、needs-counterexample还缺最近反例、good first issue上下文足够、适合上手的小任务。进入判定库有两个正式落点落点一配对 JSON 用例决策函数回归用例放在 cases/0.0.1/目前共9 组 Bad/Good 配对。以哈希家族为例STS-H-002-B.json 声明hashPolicy: deny下出现hashIntent: true的写操作预期结果是deny_and_explain理由码HASH_NOT_AUTHORIZED而配对的 STS-H-002-G.json 把同一事实中的授权翻转预期放行。一个事实变化反转判定——这就是最小对比也是你的案例被写成 JSON 时的标准形状。写好用例后运行npm run eval验证。用例字段来自输入语义标签不等于宿主能自动推断这些事实这一点要在 PR 里说明。落点二CaseBundle v1 任务完整的模型级任务带 fixture 和验收标准则创建CaseBundle v1结构约束见 schemas/case-bundle-v1.schema.json。创建与校验命令npm run sts -- case new --id slug npm run sts -- case validate evals/codex-paired/cases/slugBundle 必须同时包含 Bad/Good 两份 fixture、确定性验收、脱敏任务文本和已确认的隐私审查Agent 指令文件、符号链接、路径逃逸和未知断言类型都会被拒绝。参考现成任务evals/codex-paired/ 下的hash、scope、intent等家族。PR 提交清单案例先行的评审规则要改判定逻辑或 HookPR 必须先命名它所改变的那个案例并且一个 PR 只解决一个关注点。评审通过意味着Bad Case 被按预期拦截、暂缓或升级配对的 Good Case 仍能继续用户请求的结果照常完成没有新的重复/循环干预信息解释了 SHIT 家族、证据和下一步。提交前跑通对应的聚焦测试以及 PR 模板中列出的npm test、npm run eval、npm run release:check。所有 PR 都需要维护者评审缺少反例、泄露私有材料或超出证据范围的声明会被直接关闭。提交红线这些内容不要交原始密钥、认证数据、私有代码、完整私有会话只有抱怨、没有可识别动作和预期替代方案把风格分歧包装成授权问题仅因改动太大就要拦下合法迁移、可访问性、回归工作的规则声称 STS 能修复它只能缓解的 Codex 运行时缺陷。小结向 Stop That Shit 贡献的完整路线就是四步用 bad-case.yml 模板提一个脱敏 Issue → 说清一个动作和最近反例 → 配合维护者补 trace/repro → 升级为 cases/0.0.1/ 的配对 JSON 或 CaseBundle 任务。发现能阻止错误规则的 Good Case与提交 Bad Case 同享署名。带上你的 trace 和反例——让下一次 Agent 判断更准这就是这份路线图的全部目标。【免费下载链接】stop-that-shitStop That Shit别再造史了面向 Codex/GPT 场景的多平台 Hook Skill Guard拦截 AI coding agent 无需求的哈希、校验和与任务范围膨胀。 A multi-platform Hook Skill Guard for AI coding agents in Codex/GPT workflows: stop unrequested hashes, checksums, and task-scope creep.项目地址: https://gitcode.com/gh_mirrors/st/stop-that-shit创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考

关于恒美微站

恒美微站专注于为个体商户、工作室提供极简自助建站服务,让每个人都能轻松拥有专业网站。

快速链接

  • 关于我们
  • 建站服务
  • 主题模板
  • 案例展示
  • 资讯中心

服务项目

  • 可视化建站
  • 拖拽编辑
  • 主题定制
  • SEO 优化
  • 网站托管

联系方式

  • 📍 地址:北京市朝阳区建国路 88 号
  • 📞 电话:400-888-8888
  • ✉️ 邮箱:info@hmyw.cn
  • 🕐 时间:周一至周日 9:00-18:00

© 2024 恒美微站 hmyw.cn 版权所有 | 京 ICP 备 12345678 号