这是什么
一个开放实验室,用于在 Claude Code 前正确使用 TypeSafe 的 System One 决策模型 Jev。它记录了实测的 bug、补丁、带警报的硬回退,以及类型化决策的适用场景。
它怎么用 Jev
Jev 针对每个新回合,根据会话状态回答一个类型化的 choice 问题,决定使用哪个模型层级。其概率输入到带有缓存保护和置信度阈值的策略中,然后本地代理选择 haiku、sonnet 或 opus。健康门在会话打开前询问一个真实决策。
用到的原语:choice
值得抄的做法
将 Jev 用作带健康门的决策层,而非聊天机器人;通过转录和计费美元来衡量。
怎么试
克隆仓库,设置 JEV_API_KEY,运行 ./install.sh jev,然后使用 jev 命令。
证据
每一行都是就 README 问 Jev 的一道题。≥ 0.60 算「是」,≤ 0.40 算「否」,中间这一段 Jev 不下判断。
- Jev 是主角是0.83
- 有 System One 用法否0.37
- 处理了不确定性未判定0.57
- 有实测数据否0.15
- 可直接跑否0.28
- 值得推荐未判定0.55
- 是模型的复刻否0.05
- 问题普遍性按 0–2 打分1.09
- 与 Jev 相关是0.99
信号由 Jev jev-1.13.0 判定,简介由 DeepSeek V4.1 Flash 于 2026年9月20日 读 README 写成。