06
用量與計費
每次請求分項計費:未快取輸入、快取輸入、快取寫入、輸出。以美元從預付點數精確扣款。
公式
cost = (prompt_tokens − cached_tokens − cache_write_tokens) × 輸入價 + cached_tokens × 快取輸入價 + cache_write_tokens × 快取寫入價 + completion_tokens × 輸出價。reasoning tokens 包含在 completion_tokens。按次模型改以 pricing.request 每次計費。
價格為 GET /models 的每 token 美元。串流與非串流同價。
點數、預扣與結算
餘額是一本帳:加值為正、扣款為負。請求轉送前先預扣最壞情況費用;回應完成後釋放預扣並扣實際費用。若供應商回報的 token 多於估算,餘額可能略為負值,之後的請求會回 402 直到加值。
稽核一筆請求
GET /generation?id=<request id> 回傳儲存的 token 數、費用、延遲,以及 usage 來自供應商還是估算。數字與儀表板顯示的一致。
curl "https://api.nxioai.com/api/v1/generation?id=gen-mued4okl-6a7778ef4d23" \ -H "Authorization: Bearer $NXIO_API_KEY"