Jev 实战该问它什么,什么留在代码里
别拿大模型
做是非题。
Jev 不写字。你把 state 和带类型的问题发给它,约 300 毫秒后每题拿回一个概率。拍板的是你的代码。
这页上的每个数字都是 Jev 自己给的;方案文字来自语言模型,会单独标注。
01一次请求长什么样

02一道现场题
改一句话,看数字动。

一道现场的 Jev 题。任务固定;改一改「观察到的结果」,Jev 会重新回答 task_done(noul,即 P(是)),约 300 毫秒。
task今晚 7 点订一张两人的桌。
Jev 只认字面——讽刺和空喊「搞定」归你的代码管:加一道题,或在 state 里要求细节
task_done—
我们发给 Jev 的题
{
"state": {
"task": "今晚 7 点订一张两人的桌。",
"observation": "预订已确认——2 位,19:00,12 号桌。"
},
"questions": {
"task_done": {
"type": "noul",
"instructions": {
"what": "Does `observation` confirm that the goal in `task` was achieved?",
"not_for": "Partial progress, a different time or party size, or a promise to book later."
},
"criteria": {
"true": "The observation confirms the task exactly as stated.",
"false": "It does not confirm the task as stated."
}
}
}
}0 = 否 · 1 = 是 · 0.5 是「不知道」,不是「中等」
自己跑:key 在 console.typesafe.ai/keys · 输入 $0.042/百万 token,输出免费 · 这道题 … token ≈ $… · 直接 fetch,不需要 SDK
还没发布可靠性图——这页的每个数字都是现场跑的,没挑过
03三种问法
noul
observation 能确认 task 里的目标达成了吗?
“预订已确认——2 位,19:00,12 号桌。”
choice
「19:00 显示没位,19:30 可选」
score
- 0 什么都没做
- 1 开始了
- 2 确认完成一个子目标
- 3 就差最后一步
- 4 全部确认完成
04从真实项目里学
Jev 的 16 种设计模式
一个只给概率的模型怎么用:从十个代码库里读出来的十六条路。
- 取景框状态最小化 · 只框这次要判的
- 菜单候选枚举 · 只能点菜单上有的
- 题库规则即问题 · 一条规则一道题
- 代笔判断与生成分离 · Jev 点头,字另外找人写
- 问卷平铺扇出 · 一题一事,一次问完
- 预问投机分支 · 每个分支都先问,只读走到的
- 盲审交叉核对 · 复核的人不能看答案
- 漏斗级联 · 便宜的先筛,贵的最后
- 信号灯分级阈值 · 红停黄看绿行
- 灰区无判断带 · 0.5 不是中等,是不知道
- 恒温器迟滞 · 20 度开,22 度关
- 记分卡组合打分 · 模型报数,代码算总分
- 验货契约校验 · 缺件不补零
- 常开常闭失败方向开关 · 断电时门开还是关,先说好
- 黑匣子记录与回放 · 记概率,不记动作
- 体检实测校准 · 题目也要量血压
用 Jev 搭的项目里 star 最多的
- ai-hedge-fund教育用途的 AI 对冲基金概念验证,含投资代理。
- OpenViking面向AI代理的开源上下文数据库,集成Jev重排序客户端。
- dub开源链接归因平台,用于短链接和转化跟踪。
- jev-ultrafast由 Jev 决定每一步操作与元素的浏览器智能体。
- QuantDinger开源AI交易操作系统,集成Jev System One。
- fast-jev-compaction用 Jev 裁剪上下文而非摘要的 Claude Code 插件。
- kev可训练的类 Jev 决策模型,基于 Qwen3.5,本地运行。
- SemIf-OpenJev在家用3090,从开放模型实现语义if。
- SemIf来自开放模型的语义 if,在家用 3090 上运行。
- fx用 Zig 编写的微小、开放、可嵌入的原生编码代理。
- memsearch为 AI 编程代理提供持久 Markdown 记忆,可选 Jev 重排序。
- jev-trader每个 Monad 区块在 Kuru MON-USDC 上做一次 AI 交易决策。