
prompt-guard 运行时外挂的 AI 合规验证器:规范只声明规则,框架只做裁决,两者完全解耦。 Python >...
Prompt
prompt-guard 运行时外挂的 AI 合规验证器:规范只声明规则,框架只做裁决,两者完全解耦。 Python >= 3.10,零第三方依赖(stdlib only)。 仓库:https://git.yztiot.com/mystw/honestguard | 版本:1.1.0(见 CHANGELOG) 它解决什么问题 AI 编码助手有三个结构性失败模式:偷懒(声称做了没做)、编造(伪造证据/数字/引用)、迎合(顺着说好话)。 prompt-guard 把"完成没有"的裁决权从 AI 手里拿走: AI 可以说"我认为改完了",但只有 python -m guard 有权输出 verdict 代码/文档里手写的 validation_passed = true、verdict = "pass" 一律判 HARD 欺骗(HONEST-001),默认直接阻断(manifest severity_override 可降 WARN,降级结果留在报表里供评审) 修复残留的墓碑注释/兼容垫片判 WARN(SCOPE-001),--strict 下升 HARD 最高原则 INV-HONEST:诚实 > 能力。能力不够必须 SKIP/escalate(exit 2)承认,绝不输出假 PASS;伪造证据直接 fail。 最终效果展望 产品成熟后的典型工作流: AI agent 在你的仓库干活 → 声称"已完成,测试通过" ↓ git commit pre-commit / pre-push hook 自动跑 guard ├─ 手写 PASS 声明 → HARD → 阻断提交(exit 1) ├─ 墓碑残留 → WARN → 放行,报告记录(--strict 升 HARD) └─ 无法诚实验证(二进制/非UTF-8/超限/符号链接逃逸…) → escalate→ 写 .guard/escalate.marker,本地放行 ↓ git push CI 权威重跑(不信本地报告;RUN_NONCE 防粘贴伪造) ├─ fail → 挡合并 └─ escalate → 聚合到人工审查门 配套生态(1.0 已交付): 检查市场:10 个内置检查(HONEST×3 / SCOPE / LAZY×4 / CONF / SECR 家族)+ generator/new_check.py 脚手架 + 六门评审 + 双签登记 确定性发布:install/release.py 固定 mtime 打包(重建字节一致)+ HASH2 钉进 hook marker + --verify 升级校验 通用 CI:generic-ci.sh 与 selfcheck.yml 同参同语义(非 Actions 系 CI 可用) 分类器插槽:fail-closed(classifier.enabled 无 opt-in/模型/后端一律 exit 2,FN=0);模型与远端签名包为终态,未做 规范入库:generator/classify.py 四分类 + C0 分诊 + checks/index.json 取片(--spec-index) 一句话:"做完了"不再由 AI 自己说了算,由可重放的证据链说了算。 你有什么想法?