这是什么
一份 Jev(TypeSafe System One)的学习与实测记录。Jev 是返回带概率的结构化答案、不生成自由文本的判断模型。面向正在评估 Jev 用于分诊、护栏、重排或函数调用的开发者。
它怎么用 Jev
demo 把 state 和类型化 questions 发到唯一的 /v1/systemone 端点,在代码里使用返回的概率和置信度。例如 01_triage.py 一次调用问 8 个问题,跑完整棵工单分诊决策树;04_function_calling.py 用 Choice 的低置信度识别多意图请求。
用到的原语:choicescorenoul
值得抄的做法
投机性扇出:把所有可能用到的问题一次全问完,因为 40 个问题和 1 个问题延迟一样。
怎么试
在 .env 写入 TYPESAFE_API_KEY,安装 requirements,然后运行 bash demo/run_all.sh。
证据
每一行都是就 README 问 Jev 的一道题。≥ 0.60 算「是」,≤ 0.40 算「否」,中间这一段 Jev 不下判断。
- Jev 是主角是0.91
- 有 System One 用法是0.78
- 处理了不确定性否0.06
- 有实测数据未判定0.52
- 可直接跑否0.34
- 值得推荐是0.73
- 是模型的复刻否0.04
- 问题普遍性按 0–2 打分0.64
- 与 Jev 相关是0.98
信号由 Jev jev-1.13.0 判定,简介由 DeepSeek V4.1 Flash 于 2026年9月20日 读 README 写成。