プライシング

诺玛AI はかんぜんな pay-as-you-go です — つかったぶんだけしはらいます。サブスクリプション、プラン、げつがく、さいていりようきんはありません。

サブスクリプションなし、プランなし、かくれコストなし。チャージしたらすぐつかえ、ざんだかはしっこうしません。

かきんほうほう#

テキストモデル(Token たんいでかきん)

かきんこうもく

せつめい

Input Tokens

インプット(prompt)でつかった token

Output Tokens

アウトプット(completion)でつかった token

Cached Tokens

キャッシュヒットしたインプット token(わりびきかかく)

そのほかのモデル

タイプ

かきんほうほう

イメージせいせい

まいすうたんいでかきん

Embeddings

インプット token たんいでかきん

りようフロー#

  • とうろく — 诺玛AI コンソールでアカウントをつくる
  • チャージ — ひつようにおうじてチャージ。ざんだかはしっこうしません
  • コール — じっさいのりようりょうでかきんし、リアルタイムでせいさん

コストかくにん#

コンソール

  • 诺玛AI コンソールにログイン
  • billing ページへすすむ
  • モデルべつ、ひづけべつのリアルタイムコストしょうさいをみる

API レスポンス

すべての API レスポンスには `usage` フィールドがあり、りようりょうをおいやすくなります:

コード
{
  "usage": {
    "prompt_tokens": 100,
    "completion_tokens": 50,
    "total_tokens": 150
  }
}

コストさいてきかのヒント#

  • てきしたモデルをえらぶ — かんたんなタスクにはライトモデルをつかい、すべてでフラッグシップモデルをつかうひつようはありません
  • Prompt Caching をゆうこうにする — くりかえしの system prompt はインプットコストを 50〜90% せつやくできます
  • max_tokens をコントロール — てきせつなアウトプットじょうげんをせっていし、ふような token しょうひをさけます
  • リクエストをまとめる — みじかいリクエストを 1 つにまとめ、くりかえし prompt のオーバーヘッドをへらします

モデルごとのリアルタイムプライスは、モデルカタログをみてください。

さいしゅうこうしん: 2026 ねん 6 がつ 23 にち