计费说明
诺玛AI 采用纯按量付费模式 — 用多少付多少,没有订阅,没有套餐,没有月费,没有最低消费。
无订阅、无套餐、无隐藏费用。充值即用,余额永不过期。
计费方式#
文本模型(按 Token 计费)
计费项
说明
Input Tokens
输入(prompt)消耗的 token
Output Tokens
输出(completion)消耗的 token
Cached Tokens
缓存命中的输入 token(优惠价格)
其他模型
类型
计费方式
图像生成
按张数计费
Embeddings
按输入 token 计费
使用流程#
- 注册 — 前往 诺玛AI 控制台 注册账号
- 充值 — 按需充值,余额永不过期
- 调用 — 按实际用量扣费,实时结算
费用查看#
控制台
- 登录 诺玛AI 控制台
- 进入 账单 页面
- 查看实时费用明细,按模型、按日期维度统计
API 响应
每个 API 响应都包含 `usage` 字段,方便追踪用量:
代码
{
"usage": {
"prompt_tokens": 100,
"completion_tokens": 50,
"total_tokens": 150
}
}费用优化建议#
- 选择合适的模型 — 简单任务使用轻量模型,无需为所有场景使用旗舰模型
- 启用 Prompt Caching — 重复的 system prompt 可节省 50-90% 输入成本
- 控制 max_tokens — 设置合理的输出长度限制,避免不必要的 token 消耗
- 合并请求 — 将多个短请求合并为一个,减少重复的 prompt 开销
各模型实时定价,请查看 模型目录 。
最后更新于 2026年6月23日