这是什么
一个仅用 Python 标准库的决策服务,面向使用 Jev(TypeSafe System One)的开发者。它封装类型化问题,提供置信度策略、按通道的决策日志、盲评估框架,以及覆盖大型技能列表的技能路由器。
它怎么用 Jev
Jev 对给定状态回答类型化问题(noul、choice、score)。服务返回校准概率,应用置信度策略将每个答案路由为行动、升级或弃权,并记录每次决策以便后续调整阈值。
用到的原语:choicescorenoul
值得抄的做法
将 Jev 作为第二语义信号与确定性检索融合;将判断分解为原子问题并用代码组合。
怎么试
export OPENCODE_ZEN_API_KEY=... 然后运行 python3 eval_preflight.py ground_truth.json 或 skill_router.py。
证据
每一行都是就 README 问 Jev 的一道题。≥ 0.60 算「是」,≤ 0.40 算「否」,中间这一段 Jev 不下判断。
- Jev 是主角是0.95
- 有 System One 用法是0.86
- 处理了不确定性否0.35
- 有实测数据否0.21
- 可直接跑是0.90
- 值得推荐未判定0.54
- 是模型的复刻否0.03
- 问题普遍性按 0–2 打分1.05
- 与 Jev 相关是0.99
信号由 Jev jev-1.13.0 判定,简介由 DeepSeek V4.1 Flash 于 2026年9月21日 读 README 写成。