这是什么
面向开发者的独立 SO-101 试验场:Bun/Effect 协调器、React 工作台、Rerun 可视化工作区、显式机器人工具和 LeRobot 硬件边界,全新检出默认使用模拟硬件。
它怎么用 Jev
决策运行器(bun run jev)通过 Vercel AI Gateway 上的 AI SDK experimental_evaluate API 调用 Jev。Jev 在支出预算内从类型化候选动作中挑选有界关节步进;每次运行写入 decision.* 事件和 JSONL 日志。
用到的原语:choice
值得抄的做法
把评估模型当作决策运行器,在类型化候选动作上做选择,并由累计美元预算封顶。
怎么试
bun install && uv sync --extra dev && bun run build && bun run dev,然后 bun run jev --smoke
证据
每一行都是就 README 问 Jev 的一道题。≥ 0.60 算「是」,≤ 0.40 算「否」,中间这一段 Jev 不下判断。
- Jev 是主角是0.71
- 有 System One 用法是0.69
- 处理了不确定性否0.05
- 有实测数据否0.11
- 可直接跑是0.91
- 值得推荐否0.31
- 是模型的复刻否0.24
- 问题普遍性按 0–2 打分0.80
- 与 Jev 相关是0.94
信号由 Jev jev-1.13.0 判定,简介由 DeepSeek V4.1 Flash 于 2026年9月20日 读 README 写成。