jevbooks

← 全部项目

openJev-verdict-2.0

Heman10x-NGU/openJev-verdict-2.0 · 项目主页

面向类型化软件工作流的校准151M非自回归决策引擎。

评测与基准29%次选分类: 校准与研究

这是什么

openJev-verdict-2.0 是一个149.6M参数的决策模型,以非自回归前向传播评估类型化决策模式(Choice、Score、Noul)并提供校准置信度。它面向企业金融、安全、客户支持和代理轨迹可观测性工作流。

它怎么用 Jev

模型接收状态和类型化问题(Choice、Score、Noul),返回校准概率。它采用双通道校准:分布头处理软标签,置信头处理正确性。确定性软件保留对阈值和业务规则的控制,使用模型进行有界语义分类。

用到的原语:choicescorenoul

值得抄的做法

在选项打乱批次之间应用对称排列KL惩罚,减少提示顺序偏差。

怎么试

运行 `cd webgpu-demo && python3 -m http.server 8080`,在Chrome或Edge中打开 http://localhost:8080。

去 GitHub 看

Jev 判的jev-1.13.0

证据

每一行都是就 README 问 Jev 的一道题。≥ 0.60 算「是」,≤ 0.40 算「否」,中间这一段 Jev 不下判断。

  • Jev 是主角0.83
  • 有 System One 用法0.25
  • 处理了不确定性0.05
  • 有实测数据0.94
  • 可直接跑0.18
  • 值得推荐0.24
  • 是模型的复刻0.93
  • 问题普遍性按 0–2 打分1.35
  • 与 Jev 相关0.91

信号由 Jev jev-1.13.0 判定,简介由 DeepSeek V4.1 Flash 于 2026年9月20日 读 README 写成。