Asalebeta
返回市場
即時行情

llama-guard-4-12b

Meta: Llama Guard 4 12B

開始購買
佔原價
100%
輸出 / 1M
0.18 USDT
線上賣家
50
呼叫 / 分鐘
0
呼叫這個模型

POST /chat/completions —— 與 OpenAI SDK 已經在發的請求相同。把 base URL 指向 asale,其他都不用改。

按 token 計費
輸入
登入
輸出

跑一次,結果會顯示在這裡。

或者在你自己的程式碼裡呼叫
curl https://gw.asale.ai/v1/chat/completions \
  -H "Authorization: Bearer $ASALE_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "llama-guard-4-12b",
    "messages": [
      {
        "role": "user",
        "content": "Say hello in one short sentence."
      }
    ]
  }'
請求欄位
欄位型別取值含義
model必填string由哪個模型處理。
messages必填text目前為止的對話,最早的在前。
max_tokensint— … 16384回答長度的上限。
temperaturenumber0 … 2越高越發散,0 為確定性輸出。
top_pnumber0 … 1核採樣:只從累計機率到此為止的候選裡挑。
top_kint0 … —只從機率最高的這麼多候選裡挑,0 為關閉。
frequency_penaltynumber-2 … 2按出現次數壓低重複用詞。
presence_penaltynumber-2 … 2壓低已出現過的詞,促使換話題。
repetition_penaltynumber0 … 2抑制重複,1 為不抑制。
min_pnumber0 … 1低於最高候選機率這一比例的詞直接丟棄。
seedint重現上一次的結果。
stopstring生成到這段文字就停下。
streamboolean邊生成邊回傳。
回應
{
  "id": "chatcmpl-…",
  "object": "chat.completion",
  "model": "llama-guard-4-12b",
  "choices": [
    {
      "index": 0,
      "message": {
        "role": "assistant",
        "content": "…"
      },
      "finish_reason": "stop"
    }
  ],
  "usage": {
    "prompt_tokens": 24,
    "completion_tokens": 12,
    "total_tokens": 36
  }
}
Token 類型原價 / 1M市場價 / 1M佔原價
輸入0.180.18100%
輸出0.180.18100%
快取讀取0.180.18100%
快取寫入0.180.18100%
通道品質

這個價格背後的供給,被量出來的樣子。是讀數,不是承諾;而且只給總數——哪一位賣家出了問題,是他和我們之間的事。

線上通道
50
已驗證通道
1/1
已證明確實在服務該模型
首位元組 (p50)
成功率
視窗內沒有已結算的請求
可售容量
100.0M
此刻掛出的 token 數

延遲與驗證取近一天的量測;成功率來自真實成交。 查看服務狀態

價格走勢

目前售價為官方原價的 100%。線上賣家越多價格越低,買入呼叫越多價格越向原價回升。

100%80%60%40%20%10%上午04:48上午05:28上午06:08上午06:48上午07:28上午08:08
上午08:47
佔原價
100%
線上賣家
50
呼叫 / 分鐘
0
市場深度
價格 / 1M賣家
0.18
1