Jev 1.13 模型卡

即時模型卡、別名、價格與限制。

目前上線的模型是 Jev 1.13,版本化 ID 為 jev-1.13.0。TypeSafe 模型卡上的所有模型都透過 POST /v1/systemone 提供服務;請求中的 model 欄位會選擇處理該次呼叫的名稱。jev-latest 是 SDK 預設值,目前會解析至 jev-1.13.0。jev-preview 目前也指向同一 ID;TypeSafe 顯示目前沒有預覽版本。若已依此模型卡調校門檻,請固定使用版本化 ID。

價格、上下文與速率限制

輸入費用為每十億個 token $42,即每百萬個 $0.042。輸出 token 免費。若請求超過文件所列的每秒 250,000 個 token 或每分鐘 1,200 次請求,會傳回 429 Too Many Requests。官方 SDK 會採退避機制重試,並在 retry-after 存在時依其指定時間等候。TypeSafe 警告,在需求高漲及 GPU 合約陸續落實期間,限制會動態調整,且可能不經通知變更。自訂與企業方案可透過 sales@typesafe.ai 洽談提高上限。

每次請求的上下文上限為 64k tokens。另有 32k tokens 的次級額度,供 state 加上最長的問題使用。Jev 只會擷取 state 一次,並平行依據它評估所有問題,因此 64k 視窗涵蓋 state 與全部問題的總量。隨著 state 塞入更多無關細節,準確率會下降;jaggedness 頁面已列出這種失敗模式。請用 speculative fan-out 打包許多小問題,不要把整座資料倉庫塞進單一欄位。

輸入僅支援文字:字串、JSON 物件或文字值陣列。不支援圖片、音訊或影片輸入。呼叫前請先把非文字內容預處理成欄位。主要訓練語言為英文。其他語言(包括中日韓文字)的準確度較低,因此自動處理非英文佇列前,請先評估 Confidence。

Jev 1.13 model card: price, rate limits, context, text-only input
Jev 1.13 模型卡:價格、速率限制、上下文、text-only 輸入。

Jev 1.13

模型識別碼
jev-1.13.0
role
versioned-id
每百萬輸入 Token 價格(美元)
0.042
計費輸出量
false
每秒詞元數
250000
每分鐘請求數
1200
上下文詞元
64000
state 加上最長問題的 Token 數
32000
input
text-only

jev-latest

模型識別碼
jev-latest
role
stable-alias
指向
jev-1.13.0
SDK 預設值
true

jev-preview

模型識別碼
jev-preview
role
preview-alias
指向
jev-1.13.0
預覽版本可用
false

別名與模型列表

別名是會解析至版本化 ID 的模型名稱,可像其他名稱一樣填入 model 欄位。jev-latest 代表最新的正式穩定版本。jev-preview 則代表最新版本,無論是否正式;有預覽版本時,它會比 jev-latest 更早更新。目前兩個名稱都指向 jev-1.13.0。

發布新版本時別名會跟著移動,因此即使你的程式碼沒有變更,其背後的回答仍可能改變。回應中的 model 欄位會回報實際作答的版本化 ID,請記錄該 ID。若 Confidence 門檻是依 jev-1.13.0 調校,重新調校前請持續傳送 jev-1.13.0。

GET /v1/models 會傳回你的帳號可傳送的名稱,以及說明與發布日期。目前其中會列出別名。即使版本化 ID(例如 jev-1.13.0)未出現在該清單中,model 欄位仍接受這些 ID。

資料處理與自訂

Jev 不會使用客戶資料進行微調或 LoRA 適配,也不會使用客戶的請求或回應進行訓練。所有帳號均由相同的 RLCD 權重提供服務。你可透過 state 的內容、指示、準則,以及程式碼中的組合方式來專門化。TypeSafe 的法律文件索引涵蓋 DPA、隱私權政策,以及企業客戶的零資料保留政策。

官方聲稱端對端回應時間為 70ms-500ms,多數查詢約為 100ms。此範圍是發布資料中的公開說法,並非本 wiki 自行測量的延遲 SLO。請連同速率限制說明一併理解:TypeSafe 擴展早期存取規模期間,吞吐量與 RPM 可能變動。

正式環境該傳送哪個名稱

若上週調校的閘門下週仍必須維持相同意義,請傳送 jev-1.13.0。若要使用 TypeSafe 目前的正式版本,且願意在每次別名移動後重新檢查 Confidence 直方圖,請傳送 jev-latest。只有在準備好接受非正式版本時才傳送 jev-preview;目前它與 jev-latest 指向同一位置。

每次呼叫都要記錄 response.model。即使送出的是別名,這個欄位仍會標示實際回應的版本化 ID。偵錯 429 或異常 Noul 時,請將它與 requestId 串接。即使端點接受 jev-1.13.0,GET /v1/models 也不一定會列出它。

只需計算輸入端費用。輸出 tokens 免費,因此 fan-out 相較於按生成內容計費的聊天模型更便宜。以 $0.042/MTok 運行每秒 10 次查詢的 Doom 式迴圈,是發布時用來說明這項成本優勢的範例。但仍須遵守 1,200 RPM 與每秒 250,000 tokens 的限制;搶先體驗期間,這些數值可能隨時變動,恕不另行通知。

業務提供自訂限制報價後,在 TypeSafe 將其發布到 docs.typesafe.ai/models 前,該數字不會列入此模型卡。在此之前,公開數字仍為每秒 250,000 個 token 及每分鐘 1,200 次請求,並明確警告可能不經通知變更。企業零資料保留屬於法律文件索引主題,不是模型卡上的切換選項。

此模型卡上,英文仍是表現最佳的語言。若需處理中日韓文字工單,應採用更嚴格的 Confidence 閘門,並先抽樣自家佇列,之後再移除人工審核。模型會接受這些字元;準確度說明代表需要實測,並非暗藏的 403。

別名移動屬於版本發布事件。TypeSafe 發布新的版本化 ID 時,請重新查看模型頁面,再判斷現有閘門是否仍然有效。本頁的模型卡適用於 Jev 1.13,並不保證 1.14 的情況。

此模型卡的輸出 token 仍然免費。因此,多放幾個問題通常比另作一次生成式呼叫便宜。

來源