计费说明

诺玛AI 采用纯按量付费模式 — 用多少付多少,没有订阅,没有套餐,没有月费,没有最低消费。

无订阅、无套餐、无隐藏费用。充值即用,余额永不过期。

计费方式#

文本模型(按 Token 计费)

计费项

说明

Input Tokens

输入(prompt)消耗的 token

Output Tokens

输出(completion)消耗的 token

Cached Tokens

缓存命中的输入 token(优惠价格)

其他模型

类型

计费方式

图像生成

按张数计费

Embeddings

按输入 token 计费

使用流程#

  • 注册 — 前往 诺玛AI 控制台 注册账号
  • 充值 — 按需充值,余额永不过期
  • 调用 — 按实际用量扣费,实时结算

费用查看#

控制台

  • 登录 诺玛AI 控制台
  • 进入 账单 页面
  • 查看实时费用明细,按模型、按日期维度统计

API 响应

每个 API 响应都包含 `usage` 字段,方便追踪用量:

代码
{
  "usage": {
    "prompt_tokens": 100,
    "completion_tokens": 50,
    "total_tokens": 150
  }
}

费用优化建议#

  • 选择合适的模型 — 简单任务使用轻量模型,无需为所有场景使用旗舰模型
  • 启用 Prompt Caching — 重复的 system prompt 可节省 50-90% 输入成本
  • 控制 max_tokens — 设置合理的输出长度限制,避免不必要的 token 消耗
  • 合并请求 — 将多个短请求合并为一个,减少重复的 prompt 开销

各模型实时定价,请查看 模型目录 。

最后更新于 2026年6月23日