Asale

模型如何定价

每个模型都按原价的一个比例出售——10% 到 100% 之间——由买家对在线卖家的压迫程度决定,每分钟重算一次。

每个可交易的模型都有一个「每 1,000 token」的价格,四类 token 各自报价。

比例

每个模型只带一个数字:它此刻卖到厂商原价的百分之几。市场页把它显示为占原价,取值在 10% 到 100% 之间。

市场价 = 原价 × 比例        比例 ∈ [0.10, 1.00]

一个模型一个比例,四类 token 共用——所以「这个模型现在是原价的 35%」是关于这个模型的事实,不需要你按 token 类型各算一遍。

什么在推动它

供给是这个模型当前在线的卖方通道数,需求是最近一分钟的调用次数。利用率就是两者相除:

u    = 最近一分钟调用数 ÷ (在线通道数 × 10)
目标 = 0.10 + 0.90 × u
  • 卖家充裕u → 0)把价格往下拉到原价的 10%
  • 买家超过卖家u ≥ 1)把价格推到原价——在这种状态持续期间,一分钱都省不下来。

发布的比例每分钟向目标走 30% 的距离,所以价格曲线是平滑的,一个冷清的分钟不会让某个模型价格腰斩。稀缺是唯一的例外:u ≥ 1 会立刻把比例钉到原价,不做平滑。

从未成交过的模型从原价的 80% 起步。

价格每分钟重算一次。

四类 token

一个请求按四类分别计价:

类型含义
input你发出去的 prompt
output模型生成的内容
cache_read命中厂商缓存的 prompt token——便宜得多
cache_write写入缓存的 prompt token

这就是为什么长对话会越聊越便宜而不是越贵:第一轮之后,prompt 的大部分都是缓存读取。以 claude-sonnet-5 为例,缓存读取的参考价是每百万 $0.20,而全新输入是 $2.00——只有十分之一。Asale 会保住这个特性,见如何帮你省钱

一个算例

claude-sonnet-5 的原价是每百万输入 token $2.00、每百万输出 $10.00——也就是每 1,000 token 2,000 与 10,000 micro-USDT。假设它当前的比例是原价的 35%,市场价即 700 与 3,500。

你发一个 max_tokens: 8192 的请求。

预先冻结   8192 × 3500 / 1000 = 28,672 µUSDT  ≈ $0.029

实际用量   输入 12,000 · 输出 900
计价       12000×700/1000 + 900×3500/1000
         = 8,400 + 3,150 = 11,550 µUSDT

平台费     11,550 × 0.08 = 924
卖家收入   10,626
退还给你   28,672 − 11,550 = 17,122

你实际付 11,550 µUSDT,约合 $0.012;按原价则是 $0.033。冻结是按 max_tokens 算的,所以看起来远大于账单——但它从来都不是扣款。

什么模型能交易

没有价格行的模型会被网关直接拒绝。这是有意的:一个没人定价的模型,等于在白嫖别人真金白银的订阅。

市场页列出当前所有可交易模型,含实时价格和可用供给。

抽成

平台在每笔结算中抽 8%。除此之外没有别的:没有月费、没有门槛、没有上架费、没有提现订阅费。