モデル料金
API はすべて token 単位で課金されます。下表は呼び出し可能なすべてのモデルの公開料率を米ドルで示し、入力・キャッシュヒットした入力・出力の 3 区分を 100 万 token あたりで表示しています。残高からの引き落としは Stars 建てで、1 ★ = $0.01 です。
課金単位
料率はすべて米ドルで表示します。残高は Stars で精算され、1 Star の額面は $0.01 に固定されています。レスポンスに含まれる Stars の値が、アカウントから実際に差し引かれる額であり、小数点以下 4 桁まで表示されます。
1 ★ = $0.01
計算式
入力 token は「キャッシュミス」と「キャッシュヒット」に分けてそれぞれ米ドル単価で課金され、出力 token は別途課金されます。この 3 項の合計がそのリクエストの元の費用(米ドル)で、1 Star の額面 $0.01 で割った値が実際に差し引かれる Stars です。
usd = (input_miss / 1e6) * in_rate_usd
+ (input_cached / 1e6) * cache_rate_usd
+ (output / 1e6) * out_rate_usd
input_miss = max(0, prompt_tokens - cached_tokens)
stars = usd / 0.01
charged = max(1, round(stars, 4)) # 单位 ★成功したリクエストの最低課金額は 1 Star です。元の費用が 1 Star を下回る場合は 1 Star、上回る場合は実際の金額が課金されます。上流が空の結果(入力 0・出力 0)を返した場合は課金されません。
公開料率($ / 100 万 token)
モデル名は、リクエストの model フィールドにそのまま入れる文字列であり、GET /v1/models が返す id と完全に一致します。料率は上流の変更に追随し、本ページが正式情報です。
| モデル | 公式直結 / サードパーティ | 入力 | キャッシュヒット | 出力 | 長文コンテキスト |
|---|---|---|---|---|---|
| 最新の料金表を読み込み中… | |||||
画像 / 動画 / 音声(回数 / 秒単位)
回数または秒単位で課金。最終価格 = max(最低料金, 基準価格 × サイズ倍率 × 画質倍率)。各段の価格は右側に計算済みです。
| モデル | 種類 | 公式直結 / サードパーティ | 基準価格 | サイズ / 解像度 | 画質 | 最低料金 |
|---|---|---|---|---|---|---|
| 最新の料金表を読み込み中… | ||||||
課金の実例
以下 2 つの例の token 数と Stars の値は、いずれも本番環境の実際の呼び出し記録から取ったもので、推定値ではありません。
約 64k token の長いコンテキストを持つリクエストで、入力のほとんどがキャッシュにヒットしないケースです。
model deepseek-v4-flash prompt_tokens 64012 (cached_tokens 2560) completion 1 input_miss 61452 / 1e6 * $0.28 = $0.01720656 input_cached 2560 / 1e6 * $0.056 = $0.00014336 output 1 / 1e6 * $0.56 = $0.00000056 ------------------------------------------------ usd $0.01735 X-Stars-Cost 0.01735 / 0.01 = 1.735 ★
続けてまったく同じプロンプトを再送すると、上流は 64k の入力 token すべてをキャッシュヒットと判定します。
model deepseek-v4-flash (same prompt, resent) prompt_tokens 64012 (cached_tokens 64000) completion 1 input_miss 12 / 1e6 * $0.28 = $0.00000336 input_cached 64000 / 1e6 * $0.056 = $0.00358400 output 1 / 1e6 * $0.56 = $0.00000056 ------------------------------------------------ usd $0.003588 ( = 0.3588 ★ ) X-Stars-Cost max(1, 0.3588) = 1 ★ ( = $0.01 )
キャッシュにより元の費用は 1.735 Stars から 0.3588 Stars まで、約 80% 下がります。ただし 1 Star の最低課金額を下回るため、この呼び出しの実際の課金は 1 Star です。キャッシュによる節約が請求額に表れるのは、コンテキストが長く再利用が多くなってからです。
1 回の呼び出しの費用を確認する
成功したレスポンスには必ず X-Stars-Cost ヘッダーが付き、その値が実際に差し引かれた Stars の数です。X-Request-Id は突合やサポート問い合わせに利用できます。
X-Stars-Cost: 1.735 X-Request-Id: req_f08c8151fc95438f9c5c524511a16806
/v1/messages および /anthropic/v1/messages では、費用がレスポンスボディの usage フィールドにも直接書き込まれます:
"usage": {
"input_tokens": 2203,
"output_tokens": 1,
"cost_stars": 1.5026,
"cost_usd": 0.015
}課金ルール
- 課金対象は成功したレスポンスのみです。認証失敗、存在しないモデル、不正なパラメータ、レート制限などのエラーレスポンスは一切課金されません。
- ストリーミングは上流が最終的に報告する usage に基づいて精算され、非ストリーミングと同じ料率です。途中で切断された場合は、実際に生成された token 分が課金されます。
- リクエスト送信前に最悪ケースの金額を残高から仮押さえし、上流が実際の usage を返した時点ですぐに過不足を精算します。差額が長期間確保されたままになることはありません。
- 残高不足の場合は 402 を返し、マイナス残高にはなりません。リクエスト単位の明細はコンソールの使用状況ページでリクエスト ID から確認できます。