Описание тарификации

诺玛AI использует исключительно модель оплаты по факту использования — платите столько, сколько потребляете: без подписок, без тарифных пакетов, без ежемесячной платы и без минимальных расходов.

Без подписок, без пакетов, без скрытых платежей. Пополнили — пользуйтесь, баланс никогда не сгорает.

Способ тарификации#

Текстовые модели (тарификация по Token)

Позиция тарификации

Описание

Input Tokens

token, израсходованные на входе (prompt)

Output Tokens

token, израсходованные на выходе (completion)

Cached Tokens

входные token, попавшие в кэш (по льготной цене)

Другие модели

Тип

Способ тарификации

Генерация изображений

тарификация по количеству изображений

Embeddings

тарификация по входным token

Порядок использования#

  • Регистрация — перейдите в консоль 诺玛AI и зарегистрируйте аккаунт
  • Пополнение — пополняйте по мере необходимости, баланс никогда не сгорает
  • Вызов — списание по фактическому расходу, расчёт в реальном времени

Просмотр расходов#

Консоль

  • Войдите в консоль 诺玛AI
  • Перейдите на страницу «Счета»
  • Просматривайте детализацию расходов в реальном времени со статистикой по моделям и по датам

Ответ API

Каждый ответ API содержит поле `usage`, что удобно для отслеживания расхода:

Код
{
  "usage": {
    "prompt_tokens": 100,
    "completion_tokens": 50,
    "total_tokens": 150
  }
}

Рекомендации по оптимизации расходов#

  • Выбирайте подходящую модель — для простых задач используйте лёгкие модели, не нужно применять флагманские модели во всех сценариях
  • Включите Prompt Caching — повторяющийся system prompt позволяет сэкономить 50–90 % затрат на входе
  • Контролируйте max_tokens — устанавливайте разумные ограничения длины вывода, чтобы избежать лишнего расхода token
  • Объединяйте запросы — объединяйте несколько коротких запросов в один, сокращая повторные расходы на prompt

Актуальные цены по каждой модели смотрите в каталоге моделей.

Последнее обновление: 23 июня 2026 г.