2026 Jev 工程实践工作手册 September 2026 · 返回目录
JEV ENGINEERING
FOR PRODUCTION AGENTS
面向生产智能体的 Jev 工程
类型化语义决策实践手册
《Jev 工程:别再让 LLM 做每一个决策》(Jev Engineering: Stop Using LLMs for Every Decision)配套手册
独立学习版。与 TypeSafe AI 无从属关系,亦未获其背书。
状态 STATE 事实 + 证据 LLM 生成工作 JEV 类型化判断 代码 CODE 执行策略 生成 → 语义判断 → 权限执行:三条独立的职责链
图 1 生成、语义判断与授权是三种彼此分离的职责。Fig. 1. Generation, semantic judgment, and authority are separate responsibilities.
摘 要 ABSTRACT

Jev 是一个决策模型(decision model),而不是会话模型。它接收结构化状态与类型化问题,返回受约束的答案及概率分布。这种接口之所以对智能体内部有用,是因为许多昂贵的调用并不需要新的语言——它们需要的是一个路由、一个评分、一个是/否的概率估计,或者一个「是否升级」的决定。生成式模型继续负责开放式工作;确定性代码继续负责精确不变式与外部权限。

本手册将这一分工发展为一门工程学科。其核心单元是决策契约(decision contract):对状态、指令、声明式结果、回退方案、阈值、允许动作与升级行为的版本化规约。契约把一次隐藏的判断,变成可评估、可记录、可审查、可回滚的生产逻辑。

全书的写法刻意偏重实操。内容涵盖:Choice、Score 与 Noul 三种原语;紧凑证据包;置信度感知路由;基于同一状态快照的并行评估;动态选项菜单;执行框架(harness)插入点;影子模式评估;校准;决策回执;以及那些常被误诊为「模型缺陷」的失败模式。目标不是最大化 Jev 的使用量,而是把生成式调用从那些从来不需要「一句话」的决策中移除。

TypeSafe 报告 Jev 形态查询的端到端延迟约为 70–500 毫秒,价格为每百万输入 token 0.042 美元,且不计输出 token 费用。其更广泛的「20–200 倍速度、40–400 倍成本」论断来自对己有利的工作流评估。这些数字应读作随工作负载而变的性能上限,而非对每次集成的承诺。类型化判断的架构价值,并不取决于是否达到宣传的最大值。

索引术语 INDEX TERMS
JevTypeSafe AI系统一模型 system one model决策契约 decision contract类型化判断 typed judgment校准 calibration置信度路由 confidence routing智能体执行框架 agent harness影子模式 shadow mode语义校验 semantic verificationChoice(单选)Score(评分)Noul(是/否概率)
← 返回目录