Asalebeta

價格與真實性

價格為什麼能低於廠商原價、低到什麼程度,以及一條通道憑什麼被認為在賣它聲稱的那個模型。

兩個問題——價格為什麼比廠商原價低,以及憑什麼認為你拿到的是標籤上那個模型。兩者都從同一件事出發:這些 token 是誰的。

token 是誰的

不是我們的。Asale 不跑任何模型,也不持有任何額度。

每個請求都由某個真實使用者的上游帳號完成:他自己的 Claude Pro / Max、ChatGPT / Codex、Gemini、Kimi、Grok 訂閱,或他自己的 API key。請求經他的機器發到服務商,回來的 token 是那個帳號真實消耗的。平台只做媒合、計量和結算。

後面兩節都從這一點長出來:

  • 價格能低於原價,因為那份額度的持有者已經付過錢了,用不完的部分對他邊際成本為零。
  • 真實性需要被檢查,因為「請求真的被轉發給了標稱的模型」協定本身證明不了——中間那台機器不是我們的。

價格

訂閱按週期付費,用不用都一樣。Claude Max 每五小時重置,視窗裡沒花掉的不會累積。註定用不到的額度邊際成本為零,低於原價賣出仍是淨收入。這就是折扣的全部來源,沒有補貼,也沒人在虧本賣。

折扣不是固定的。每個模型帶一個比例——此刻賣到廠商原價的百分之幾,每分鐘按買家對線上通道的壓迫程度重算:

市場價 = 原價 × 比例        比例 ∈ [0.10, 1.00]

賣家多於買家時比例往 10% 走;反過來會被推回去,必要時一路到原價,直到報價更高的賣家願意進場。所以「低至一折」是區間下端,不是常態價——做計畫前先看市場頁

平台從每筆成交抽 8%,其餘歸實際提供服務的那台裝置。演算法與算例見模型如何定價

為什麼便宜的 token 常常不是它說的那個模型

任何人都可以聲明自己在賣 claude-opus-5。連線是通的,usage 能解析,通道也確實出現在市場上。協定裡沒有任何東西能證明那些 token 來自標籤上的模型。

把請求轉給價格只有百分之一的模型,常規檢查一條都不會觸發。這個價差就是套利空間。常見三種做法:

  • 用中檔模型或量化鏡像,頂著旗艦的名字應答;
  • 把讓貴模型之所以貴的參數剝掉——思考預算、工具 schema、快取斷點;
  • 回程把 token 數報高,同一個答案收更多錢。

三種都不會在回應裡留下明顯痕跡。一段短回覆看上去就是一段短回覆。

上市前:先賣給平台

遠端證明沒法確認一台陌生機器上跑的是哪個二進位檔。可以做的是比對行為:提一些答案取決於生成它的模型本身的問題,看回答像不像它聲稱的那個模型。

一條通道是 (裝置, 服務商, 模型) 三元組,各自獨立驗證;便宜模型上拿到的判決不會給貴模型背書。

  1. 平台從正門買十來次

    同一個閘道、同一種派單訊框、和買家請求完全相同的路徑,只是被釘在這一台裝置上。整輪兩側都按零結算:不扣買家的錢,也不給賣家結錢。它會消耗賣家自己的訂閱額度。

  2. 打分,寫下判決

    分數 ≥ 75 且沒有硬閘門命中為 pass。結論不明確或分數偏低但沒有硬證據為 watch——仍然可以賣,只是抽檢率提高十倍、排序下降。只有命中硬閘門且估計器信心不低於 0.6 才是 reject,該通道下架。

  3. 通過之前買家看不到

    未驗證的通道不會被媒合給任何買家。這不是「上線慢」:離開這個狀態的唯一途徑是平台先從它這裡買一次。

一次不明確的執行不作為欺詐證據。一個在兩次執行之間能跳一整檔的統計量,拿來把賣家趕出市場是不合適的。

上市後:抽檢

預告過的考試是可以臨時應付的。所以已驗證的通道會在它無法預測的時刻被重新探測,走同一個正門,外層與任何一次購買完全一樣:

已驗證通道被抽檢的流量佔比1%
處於 watch、或所屬帳號出過拒絕判決時10%
在售通道兩次抽檢的最長間隔(無論流量多少)72 小時
一個通過判決的有效期7 天

時間上限和百分比一樣重要:沒有它,一條沒有買家的通道就永遠不會被檢查,而「讓自己在兩次抽檢之間沒有買家」是可以安排的。

抽檢按市價付錢給賣家。這不是慷慨——不付錢的抽檢會在收益流水裡留下缺口,缺口就是作弊者可以盯的標記。一次抽檢還會攤開到將近一小時,而不是連著打一梭子:二十一個請求按固定順序連發是一種形狀,形狀可以被認出來。

和同類通道比

市場能同時看到很多條在賣同一模型的通道,所以問題不必是抽象的「這是不是 Opus」,而可以是「這條通道的表現和其他 Opus 通道一樣嗎」——更容易,也更穩定。

只追蹤能穿過中繼依然成立的數字:寫多長、開始生成後多快、各難度檔的正確率。不涉及提示內容,也不含能指認賣家的資訊。一個模型至少要有八條通道,群體輪廓才算數。偏離三個標準差以上的通道會被安排更深的複檢,而不是被拒絕——某個模型的第一個賣家、某地區唯一的賣家,都是離群點,但不是騙子。

題目為什麼不公開

驗證引擎 llm-verify 是開源的,任何人都可以審查它問了什麼。這同時是它的天花板:被探測的賣家也能讀到這套題,於是老實答這些題,把其餘流量轉走。

所以真正決定判決的評分題,按每次執行的伺服器端種子現場生成:多步推導、答案唯一且可校驗,本地算出而非查表。種子寫進報告,有爭議的判決可以逐題重現。

題目刻意不是常識問答——常識問答測的是訓練語料,語料大的便宜模型也能過。要抓的不是把噪聲當 Opus 賣(那在第一道身分探測就露餡),而是把中檔模型或量化鏡像當旗艦賣,這兩者都答得對「你是誰做的」。區分它們的是最難那一檔的正確率。

計費

價格以上游服務商回報的 usage 為準。圍繞它:

  • 閘道獨立數一遍同一個請求,兩個數放在一起比。自報數持續偏離的通道按計量問題處理,與真實性分開追蹤。
  • 四類 token 分開計價:輸入、輸出、快取讀取、快取寫入。快取讀取約為全新輸入的十分之一,長的 agent 對話絕大部分是快取讀取。
  • 一次對話十分鐘內固定到同一個賣家,因為快取只對寫下它的那個上游帳號有效。
  • 請求出錯、用量回傳為零、你中途斷線、賣家在發出第一個位元組前掉線,都不計費。預授權凍結按 max_tokens 算,不是扣款,沒用掉的原路退回。

這套做法解決不了什麼

  • **沒有辦法證明遠端跑的是哪個二進位檔。**以上全是行為層面的推斷,不是密碼學證明。
  • **驗證是抽樣。**已驗證通道 1% 的流量被檢查,不是每個請求。兩次抽檢之間作弊,會在下一次被抓到,而不是當場。
  • **watch 判決仍然在賣。**結論不明確的通道不會下架,只是檢查更頻繁、排序下降。
  • **供給薄的時候這裡不便宜。**比例會一路回到原價。它是即時數字,不是承諾。
  • **不是端到端加密。**你的請求經由另一個使用者的用戶端轉發,對方能看到內容。見安全

驗證引擎與 token 計量是兩個獨立的 Apache-2.0 crate,發布在 crates.io 上,就是這裡跑的那份程式碼。你可以拿去對任何端點跑,包括我們的。