Описание тарификации
诺玛AI использует исключительно модель оплаты по факту использования — платите столько, сколько потребляете: без подписок, без тарифных пакетов, без ежемесячной платы и без минимальных расходов.
Без подписок, без пакетов, без скрытых платежей. Пополнили — пользуйтесь, баланс никогда не сгорает.
Способ тарификации#
Текстовые модели (тарификация по Token)
Позиция тарификации
Описание
Input Tokens
token, израсходованные на входе (prompt)
Output Tokens
token, израсходованные на выходе (completion)
Cached Tokens
входные token, попавшие в кэш (по льготной цене)
Другие модели
Тип
Способ тарификации
Генерация изображений
тарификация по количеству изображений
Embeddings
тарификация по входным token
Порядок использования#
- Регистрация — перейдите в консоль 诺玛AI и зарегистрируйте аккаунт
- Пополнение — пополняйте по мере необходимости, баланс никогда не сгорает
- Вызов — списание по фактическому расходу, расчёт в реальном времени
Просмотр расходов#
Консоль
- Войдите в консоль 诺玛AI
- Перейдите на страницу «Счета»
- Просматривайте детализацию расходов в реальном времени со статистикой по моделям и по датам
Ответ API
Каждый ответ API содержит поле `usage`, что удобно для отслеживания расхода:
{
"usage": {
"prompt_tokens": 100,
"completion_tokens": 50,
"total_tokens": 150
}
}Рекомендации по оптимизации расходов#
- Выбирайте подходящую модель — для простых задач используйте лёгкие модели, не нужно применять флагманские модели во всех сценариях
- Включите Prompt Caching — повторяющийся system prompt позволяет сэкономить 50–90 % затрат на входе
- Контролируйте max_tokens — устанавливайте разумные ограничения длины вывода, чтобы избежать лишнего расхода token
- Объединяйте запросы — объединяйте несколько коротких запросов в один, сокращая повторные расходы на prompt
Актуальные цены по каждой модели смотрите в каталоге моделей.
Последнее обновление: 23 июня 2026 г.