这是什么
面向编码代理的验证原型:本地 Responses 代理让一个 Codex 会话在每次有意义的调用上重新选择 GPT 模型与推理档位,任务结束后再独立验收任务是否仍然通过。
它怎么用 Jev
代理构建宿主当前确实可请求的 (模型, effort) 候选对,交给 Jev 做一次 Choice,同时决定模型和推理档位。超时、低置信或无效回答会回退到 Terra/medium 并记录原因。Router Compass 记录每次选择、实际用量与验收结果。
用到的原语:choice
值得抄的做法
把选择点放在每次模型调用而非每个任务,并在任务结束后独立验收,而不是相信执行模型的自报成功。
怎么试
npm ci;npm run build;JEV_API_KEY=" " npm start;curl localhost:8787/health;npm test
证据
每一行都是就 README 问 Jev 的一道题。≥ 0.60 算「是」,≤ 0.40 算「否」,中间这一段 Jev 不下判断。
- Jev 是主角是0.94
- 有 System One 用法是0.77
- 处理了不确定性否0.05
- 有实测数据否0.06
- 可直接跑未判定0.53
- 值得推荐未判定0.43
- 是模型的复刻否0.04
- 问题普遍性按 0–2 打分1.06
- 与 Jev 相关是0.98
信号由 Jev jev-1.13.0 判定,简介由 DeepSeek V4.1 Flash 于 2026年9月20日 读 README 写成。