jevbooks

← 全部项目

jev-forge

zwliJay/jev-forge · 项目主页

用于训练和部署 Jev 风格决策模型的开源栈。

Agent 决策76%次选分类: 打分与排序题目体检

这是什么

JevForge 是一个端到端工具包,用于合成决策数据、训练校准的候选评分器、评估它们,并为交互式网页决策提供 Jev 兼容的推理服务。它面向构建结构化决策模型的研究人员和开发者。

它怎么用 Jev

JevForge 提供 Jev 兼容的 API,接受状态和类型化问题(choice、noul、score)。它将每个问题扩展为 K 个候选行,用两层 GELU 评分器对每个候选评分,并仅归一化该问题的 K 个 logits,返回候选上的概率分布。

用到的原语:choicenoulscore

值得抄的做法

池化最后一个有效 token,对每个候选应用共享的两层 GELU 评分器,并仅对每个问题的 K 个 logits 进行归一化。

怎么试

bash scripts/run_mac_demo.sh

去 GitHub 看

Jev 判的jev-1.13.0

证据

每一行都是就 README 问 Jev 的一道题。≥ 0.60 算「是」,≤ 0.40 算「否」,中间这一段 Jev 不下判断。

  • Jev 是主角0.90
  • 有 System One 用法未判定0.50
  • 处理了不确定性0.06
  • 有实测数据0.23
  • 可直接跑0.72
  • 值得推荐未判定0.59
  • 是模型的复刻0.95
  • 问题普遍性按 0–2 打分1.01
  • 与 Jev 相关0.97

信号由 Jev jev-1.13.0 判定,简介由 DeepSeek V4.1 Flash 于 2026年9月20日 读 README 写成。