jevbooks

← 全部项目

Canny

qkal/Canny

用证据账本阻止 AI 编码代理在无证据时声称完成。

校验与安全门55%次选分类: Agent 决策

这是什么

Canny 是 AI 编码代理的看守。它挂接到 Claude Code 和 Codex CLI,用只追加的账本记录代理实际做了什么,并拒绝让代理凭一句无证据的声明收工。

它怎么用 Jev

Jev 回答两个 Noul 是/否问题:某次编辑是否违反 CLAUDE.md 或 AGENTS.md 中的规则(仅作提示),以及代理的最后一条消息是否声称工作已完成。第二个问题只能放宽完成门禁,不能收紧。

用到的原语:noul

值得抄的做法

按内容哈希缓存 Jev 的回答,并只在宽置信区间之外行动,使判定在模型漂移下仍保持稳定。

去 GitHub 看

Jev 判的jev-1.13.0

证据

每一行都是就 README 问 Jev 的一道题。≥ 0.60 算「是」,≤ 0.40 算「否」,中间这一段 Jev 不下判断。

  • Jev 是主角0.35
  • 有 System One 用法0.31
  • 处理了不确定性0.05
  • 有实测数据0.05
  • 可直接跑0.96
  • 值得推荐0.18
  • 是模型的复刻0.08
  • 问题普遍性按 0–2 打分1.38
  • 与 Jev 相关0.86

信号由 Jev jev-1.13.0 判定,简介由 DeepSeek V4.1 Flash 于 2026年9月21日 读 README 写成。