模型如何定價
每個模型都按原價的一個比例出售,10% 到 100% 之間,由當下的供需鬆緊決定,每分鐘重算一次。
每個可交易的模型都有一個「每 1,000 token」的價格,四類 token 各自報價。
比例
每個模型只帶一個數字:它此刻賣到廠商原價的百分之幾。市場頁把它顯示為佔原價,取值在 10% 到 100% 之間。
市場價 = 原價 × 比例 比例 ∈ [0.10, 1.00]
一個模型一個比例,四類 token 共用——所以「這個模型現在是原價的 35%」說的就是整個模型,不用你按 token 類型各算一遍。
什麼在影響它
供給是這個模型目前上線的賣方通道數,需求是最近一分鐘的呼叫次數,兩者一除就是使用率:
u = 最近一分鐘呼叫數 ÷ (上線通道數 × 10)
目標 = 0.10 + 0.90 × u
- 賣方充裕(
u → 0)把價格往下拉到原價的 10%。 - 目前價格檔滿載(
u ≥ 1)時,價格先抬到更高報價中最低的下一檔,讓對應賣家加入;只有沒有下一檔供給時才到原價。
公布的比例通常每分鐘向目標靠攏 30%,所以價格曲線是平滑的,某一分鐘冷清一點不會讓模型價格腰斬。價格檔滿載是例外:系統會直接跳到下一檔賣家的最低保留價,不做平滑,因為低於這個價根本開不出新通道。
從未成交過的模型從原價的 80% 起步。
價格每分鐘重算一次。
四類 token
一個請求依四類分別計價:
| 類型 | 含義 |
|---|---|
input | 你送出的 prompt |
output | 模型產生的內容 |
cache_read | 命中廠商快取的 prompt token——便宜得多 |
cache_write | 寫入快取的 prompt token |
這就是為什麼長對話會越聊越便宜而不是越貴:第一輪之後,prompt 的大部分都是快取讀取。以 claude-sonnet-5 為例,快取讀取的參考價是每百萬 $0.20,而全新輸入是 $2.00——只有十分之一。Asale 會保住這個特性,見如何幫你省錢。
一個算例
claude-sonnet-5 的原價是每百萬輸入 token $2.00、每百萬輸出 $10.00——也就是每 1,000 token 2,000 與 10,000 micro-USDT。假設它目前的比例是原價的 35%,市場價即 700 與 3,500。
你送出一個 max_tokens: 8192 的請求。
預先凍結 8192 × 3500 / 1000 = 28,672 µUSDT ≈ $0.029
實際用量 輸入 12,000 · 輸出 900
計價 12000×700/1000 + 900×3500/1000
= 8,400 + 3,150 = 11,550 µUSDT
平台費 11,550 × 0.08 = 924
賣方收入 10,626
退還給你 28,672 − 11,550 = 17,122
你實際付 11,550 µUSDT,約合 $0.012;按原價要 $0.033。凍結是按 max_tokens 算的,所以看著比帳單大得多——但它本來就不是扣款。
什麼模型能交易
沒有價格列的模型會被閘道直接拒絕。這是刻意的:一個沒人定價的模型,等於在白拿別人真金白銀的訂閱。
市場頁列出目前所有可交易模型,含即時價格與可用供給。
抽成
平台在每筆結算中抽 8%。除此之外沒有別的:沒有月費、沒有門檻、沒有上架費、沒有提領訂閱費。