Jev 1.13 · QuickSilver Pro
Jev 1.13 是 TypeSafe 的 System One 模型。它不生成文本:你发送一个 state 和一组带类型的问题,它在一次前向传播中逐一作答 —— 从你给出的选项中选一个、把 state 放到你定义的量表上,或返回一个偏向「是」的概率 —— 并附上经过校准的概率。通过 POST /v1/systemone 调用,使用与目录中其他模型相同的 QuickSilver Pro key 和美元余额:每百万输入 token $0.042,输出 token 免费。
概览
以校准概率的形式给出路由、分类、分诊和护栏决策 —— 无需解析任何内容。
价格对比($/1M token)
| 服务商 | 输入 | 输出 | 对比 QSP |
|---|---|---|---|
| QuickSilver Pro | $0.042 | 免费 | — |
| TypeSafe 刊例价 (jev-1.13) | $0.042 | 免费 | 相同 |
适用场景
凡是你的代码需要的是一个决策而不是一段文字的地方,都可以用 Jev 1.13:把请求路由到合适的模型或队列、对工单进行分类或分诊、按评分标准给内容打分、内容审核和护栏检查,或者选择 agent 的下一步。每个答案返回时都带类型 —— 一个附带各选项概率和置信度的选择、一个分数,或一个概率 —— 所以没有自由文本要解析,也没有 JSON 要修复,你可以对概率设阈值,而不必盲信一个光秃秃的标签。单次调用中最多 64 个问题可以共用同一个 state;由于只对输入计费,对一个 1,000 token 的 state 做一次决策大约花费 $0.00004。
何时该选其他模型
Jev 1.13 不生成文本 —— 没有回答、摘要、代码或工具调用 —— 也无法通过 Chat Completions 访问;任何生成类任务请使用对话模型。它的窗口是 32K token,所以长文档请先裁剪或摘要,再就其提问。响应不支持流式输出,一次调用端到端通常需要约 2–3 秒,因此对于紧凑的循环,请把多个问题放进同一个请求,而不是发起多次调用。
快速开始:POST /v1/systemone(curl)
curl https://api.quicksilverpro.io/v1/systemone \
-H "Authorization: Bearer $QSP_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "jev-1.13",
"state": "hi",
"questions": {
"greeting": {
"type": "choice",
"instructions": "Is the state a greeting?",
"criteria": {"yes": "it is a greeting", "no": "it is not a greeting"}
}
}
}'
# {"id":"so-45a870bb532d4a72b41404cc8911c72e","model":"jev-1.13",
# "answers":{"greeting":{"type":"choice","choice":"yes",
# "probabilities":{"no":0.07,"yes":0.93},"confidence":0.87}},
# "usage":{"input_tokens":314,"output_tokens":33,"cost":...,"currency":"USD"}}import os, requests
resp = requests.post(
"https://api.quicksilverpro.io/v1/systemone",
headers={"Authorization": f"Bearer {os.environ['QSP_KEY']}"},
json={
"model": "jev-1.13",
"state": {"ticket": "I was charged twice for my subscription this month."},
"questions": {
"queue": {
"type": "choice",
"instructions": "Which team should handle this ticket?",
"criteria": {
"billing": "payments, charges, refunds, invoices",
"technical": "bugs, errors, integrations",
"account": "login, email, profile changes",
},
},
"urgent": {
"type": "noul",
"instructions": "Does this ticket need a reply within the hour?",
},
},
},
timeout=30,
)
resp.raise_for_status()
data = resp.json()
queue = data["answers"]["queue"]
print(queue["choice"], queue["probabilities"]) # picked queue + per-option probabilities
print(data["answers"]["urgent"]["noul"]) # probability-like number
print(data["usage"]) # input_tokens, output_tokens, cost这是 System One API,不是 Chat Completions:发送 state 和带类型的 questions,返回带概率的结构化答案。与其他模型共用同一把 key 和余额。 System One 完整文档 →
常见问题
一种做决策而不是写文本的模型。你发送一个 state —— 任意 JSON,字符串或对象均可 —— 外加一组带类型的问题,Jev 1.13 会在一次前向传播中回答所有问题,并给出经过校准的概率。问题有三种类型:choice(从你指定的选项中选一个,并给出每个选项的概率)、score(把 state 放到你描述的量表上)和 noul(针对偏向「是」的问题给出一个类似概率的数值)。
POST https://api.quicksilverpro.io/v1/systemone,以 Bearer token 的形式带上你的 QuickSilver Pro key,JSON 请求体中包含 model、state 和 questions —— 每次调用最多 64 个问题。它是一个普通的 HTTPS JSON endpoint,所以 curl、requests 或 httpx 都能用。它不属于 OpenAI Chat Completions 接口:对 jev-1.13 发起 chat 调用会被拒绝,也不支持流式输出。/docs/systemone 指南中有完整的 schema、全部三种问题类型和错误码。
只对输入 token 计费,每百万 $0.042 —— 输出 token 免费。每个响应的 usage 块都会报告 input_tokens、output_tokens 以及该次调用的美元成本,并从与其他所有模型相同的预付余额中扣除。这是 TypeSafe 自家的刊例价;QuickSilver Pro 不加价。
答案以你选定的问题 ID 为键。choice 问题会返回被选中的选项、每个选项的概率以及一个置信度 —— 例如 {"type":"choice","choice":"yes","probabilities":{"no":0.07,"yes":0.93},"confidence":0.87}。noul 问题返回单个数值,例如 {"type":"noul","noul":0.69}。响应中还带有一个 id、model 以及包含该次调用成本的 usage 块。