openjev-latest API(base64)
OpenJev(模型名 codiv/openjev-latest)由离散扩散语言模型 DiffusionGemma 26B-A4B 转换而来,是与 TypeSafe Jev(typesafe/jev-latest)在 wire 层完全兼容的决策模型:同一协议、相同的问题类型与响应结构,并额外支持图片评估(images,最多 8 张,仅支持 base64 )与 steps / samples / think / sequential 四个可选参数。不传这些参数时行为与 TypeSafe Jev 完全一致,面向 TypeSafe 写的客户端代码可直接复用。当前上线初期限时免费。
端点列表
OpenJev 与 TypeSafe Jev 怎么选
| 维度 | TypeSafe Jev(typesafe/jev-latest) | OpenJev(codiv/openjev-latest) |
|---|---|---|
| 底层实现 | System One 原生模型 | 由离散扩散语言模型 DiffusionGemma 26B-A4B 转换而来 |
| 协议 | 完全兼容(同一协议、相同的问题类型与响应结构),面向 TypeSafe 写的客户端代码可直接复用 | |
| 图片输入 | 不支持(仅纯文本) | 支持 images(最多 8 张,base64 / data URL) |
| 扩展参数 | — | steps / samples / think / sequential |
| 计费 | 按 token | 当前限时免费 |
工作原理:答案槽位的一次去噪读取
OpenJev 将离散扩散语言模型 DiffusionGemma 26B-A4B 转换为 System One 模型:它把答案模板预先写入模型的画布(canvas),推理时只把答案槽位当作噪声,并通过一次去噪步骤读取每个槽位的概率分布。
由于不存在答案生成与解析的过程,答案永远不会超出你定义的模式(schema)——这正是它与「先生成再解析」式 LLM 结构化输出的本质区别。
限时免费
OpenJev 上线初期限时免费。当前调用不产生费用;恢复计费前会在本页更新说明。计费体系按 token 设计(见下方「计费与限制」),恢复后按实报
usage 计量。问题类型(questions.*.type)
| type | 含义 | criteria | 答案字段 |
|---|---|---|---|
noul | 是/否问题,返回「是」的概率 | 可选,{"true":"…","false":"…"} | noul (0~1) |
choice | 从选项里选一个 | 必填,{"<选项>":"<说明>"},值可为 null,1~128 个 | choice + probabilities + confidence |
score | 按档位打分 | 必填,["档位0","档位1", …],2~10 档 | score + legend + probabilities + confidence |
图片与扩展参数(images / steps / samples / think / sequential)
OpenJev 在 TypeSafe Jev 协议之上额外支持五个可选参数。全部不传时行为与 TypeSafe Jev 完全一致。
| 参数 | 取值 | 说明 |
|---|---|---|
images | 数组,最多 8 张 | 待评估图片,放在 state 之前、按发送顺序排列,state 可以写「第一张是维修前,第二张是维修后」这类指代。每张约 280 input tokens(与尺寸无关)。两种形态二选一:data URL 字符串(data:image/jpeg;base64,…)或 {"content_type":"image/png","base64":"…"} 对象。支持 JPEG / PNG / WebP / GIF(GIF 只取第一帧),单张最大 5 MB(base64 解码后)。建议先缩到长边约 1024 像素并转 JPEG,请求更小更快。 |
steps | 1~8,默认 1 | 去噪步数(每次读取的 denoise steps)。可与 images 同用。 |
samples | 1~32 | 重复读取次数:每次用不同噪声读取并对结果取平均,用于降低方差。每次读取都会计费,会成倍放大实际用量。可与 images 同用。 |
think | 0~4096 | 思考预算(token),是硬上限。设置后 usage.output_tokens 非 0(thought 的长度)。需要纯文本 state。 |
sequential | boolean | 按问题分块顺序读取:每块能看到先前块的答案。需要纯文本 state。 |
think 与 sequential 不能与 images 同时使用(返回 HTTP 422);图片格式不支持或单图超过 5 MB 也会透传上游 422。计费与限制
- 按 token 计费,用量取上游实报的
usage.input_tokens/usage.output_tokens(当前限时免费)。 - 每张图片按约 280 input tokens 计入(与图片尺寸无关,模型以固定预算看图)。
samples会重复计费:读 1~32 次,每次读取都计费。think会让usage.output_tokens非 0(thought 的长度),同样计入计费。- 不支持流式:请求体带
stream: true会被拒绝(HTTP 400)。
答案 key 与请求 key 一一对应
questions 的每个 key 由调用方自取,answers 会以同名 key 返回。key 本身不下发给模型、不参与推理。