模型如何定价
每个模型都按原价的一个比例出售——10% 到 100% 之间——由买家对在线卖家的压迫程度决定,每分钟重算一次。
每个可交易的模型都有一个「每 1,000 token」的价格,四类 token 各自报价。
比例
每个模型只带一个数字:它此刻卖到厂商原价的百分之几。市场页把它显示为占原价,取值在 10% 到 100% 之间。
市场价 = 原价 × 比例 比例 ∈ [0.10, 1.00]
一个模型一个比例,四类 token 共用——所以「这个模型现在是原价的 35%」是关于这个模型的事实,不需要你按 token 类型各算一遍。
什么在推动它
供给是这个模型当前在线的卖方通道数,需求是最近一分钟的调用次数。利用率就是两者相除:
u = 最近一分钟调用数 ÷ (在线通道数 × 10)
目标 = 0.10 + 0.90 × u
- 卖家充裕(
u → 0)把价格往下拉到原价的 10%。 - 买家超过卖家(
u ≥ 1)把价格推到原价——在这种状态持续期间,一分钱都省不下来。
发布的比例每分钟向目标走 30% 的距离,所以价格曲线是平滑的,一个冷清的分钟不会让某个模型价格腰斩。稀缺是唯一的例外:u ≥ 1 会立刻把比例钉到原价,不做平滑。
从未成交过的模型从原价的 80% 起步。
价格每分钟重算一次。
四类 token
一个请求按四类分别计价:
| 类型 | 含义 |
|---|---|
input | 你发出去的 prompt |
output | 模型生成的内容 |
cache_read | 命中厂商缓存的 prompt token——便宜得多 |
cache_write | 写入缓存的 prompt token |
这就是为什么长对话会越聊越便宜而不是越贵:第一轮之后,prompt 的大部分都是缓存读取。以 claude-sonnet-5 为例,缓存读取的参考价是每百万 $0.20,而全新输入是 $2.00——只有十分之一。Asale 会保住这个特性,见如何帮你省钱。
一个算例
claude-sonnet-5 的原价是每百万输入 token $2.00、每百万输出 $10.00——也就是每 1,000 token 2,000 与 10,000 micro-USDT。假设它当前的比例是原价的 35%,市场价即 700 与 3,500。
你发一个 max_tokens: 8192 的请求。
预先冻结 8192 × 3500 / 1000 = 28,672 µUSDT ≈ $0.029
实际用量 输入 12,000 · 输出 900
计价 12000×700/1000 + 900×3500/1000
= 8,400 + 3,150 = 11,550 µUSDT
平台费 11,550 × 0.08 = 924
卖家收入 10,626
退还给你 28,672 − 11,550 = 17,122
你实际付 11,550 µUSDT,约合 $0.012;按原价则是 $0.033。冻结是按 max_tokens 算的,所以看起来远大于账单——但它从来都不是扣款。
什么模型能交易
没有价格行的模型会被网关直接拒绝。这是有意的:一个没人定价的模型,等于在白嫖别人真金白银的订阅。
市场页列出当前所有可交易模型,含实时价格和可用供给。
抽成
平台在每笔结算中抽 8%。除此之外没有别的:没有月费、没有门槛、没有上架费、没有提现订阅费。