Détails de facturation

诺玛AI adopte un modèle de paiement purement à l'usage — vous payez exactement ce que vous consommez, sans abonnement, sans forfait, sans frais mensuels, sans consommation minimale.

Aucun abonnement, aucun forfait, aucuns frais cachés. Rechargez et utilisez immédiatement, votre solde n'expire jamais.

Mode de facturation#

Modèles de texte (facturation au Token)

Élément de facturation

Description

Input Tokens

token consommés en entrée (prompt)

Output Tokens

token consommés en sortie (completion)

Cached Tokens

token d'entrée en cache hit (tarif préférentiel)

Autres modèles

Type

Mode de facturation

Génération d'images

facturation à l'image

Embeddings

facturation aux token d'entrée

Procédure d'utilisation#

  • Inscription — rendez-vous sur la console 诺玛AI pour créer un compte
  • Recharge — rechargez selon vos besoins, votre solde n'expire jamais
  • Appel — facturation selon l'utilisation réelle, règlement en temps réel

Consultation des coûts#

Console

  • Connectez-vous à la console 诺玛AI
  • Accédez à la page Facture
  • Consultez le détail des coûts en temps réel, ventilé par modèle et par date

Réponse de l'API

Chaque réponse de l'API contient un champ `usage`, ce qui facilite le suivi de l'utilisation :

Code
{
  "usage": {
    "prompt_tokens": 100,
    "completion_tokens": 50,
    "total_tokens": 150
  }
}

Conseils d'optimisation des coûts#

  • Choisissez le modèle adapté — utilisez un modèle léger pour les tâches simples, inutile de recourir au modèle phare pour tous les cas d'usage
  • Activez le Prompt Caching — un system prompt répété permet d'économiser 50 à 90 % du coût d'entrée
  • Maîtrisez max_tokens — définissez une limite raisonnable de longueur de sortie pour éviter une consommation inutile de token
  • Regroupez les requêtes — fusionnez plusieurs requêtes courtes en une seule pour réduire le coût répété du prompt

Pour la tarification en temps réel de chaque modèle, consultez le catalogue de modèles.

Dernière mise à jour le 23 juin 2026