プライシング
诺玛AI はかんぜんな pay-as-you-go です — つかったぶんだけしはらいます。サブスクリプション、プラン、げつがく、さいていりようきんはありません。
サブスクリプションなし、プランなし、かくれコストなし。チャージしたらすぐつかえ、ざんだかはしっこうしません。
かきんほうほう#
テキストモデル(Token たんいでかきん)
かきんこうもく
せつめい
Input Tokens
インプット(prompt)でつかった token
Output Tokens
アウトプット(completion)でつかった token
Cached Tokens
キャッシュヒットしたインプット token(わりびきかかく)
そのほかのモデル
タイプ
かきんほうほう
イメージせいせい
まいすうたんいでかきん
Embeddings
インプット token たんいでかきん
りようフロー#
- とうろく — 诺玛AI コンソールでアカウントをつくる
- チャージ — ひつようにおうじてチャージ。ざんだかはしっこうしません
- コール — じっさいのりようりょうでかきんし、リアルタイムでせいさん
コストかくにん#
コンソール
- 诺玛AI コンソールにログイン
- billing ページへすすむ
- モデルべつ、ひづけべつのリアルタイムコストしょうさいをみる
API レスポンス
すべての API レスポンスには `usage` フィールドがあり、りようりょうをおいやすくなります:
コード
{
"usage": {
"prompt_tokens": 100,
"completion_tokens": 50,
"total_tokens": 150
}
}コストさいてきかのヒント#
- てきしたモデルをえらぶ — かんたんなタスクにはライトモデルをつかい、すべてでフラッグシップモデルをつかうひつようはありません
- Prompt Caching をゆうこうにする — くりかえしの system prompt はインプットコストを 50〜90% せつやくできます
- max_tokens をコントロール — てきせつなアウトプットじょうげんをせっていし、ふような token しょうひをさけます
- リクエストをまとめる — みじかいリクエストを 1 つにまとめ、くりかえし prompt のオーバーヘッドをへらします
モデルごとのリアルタイムプライスは、モデルカタログをみてください。
さいしゅうこうしん: 2026 ねん 6 がつ 23 にち