Détails de facturation
诺玛AI adopte un modèle de paiement purement à l'usage — vous payez exactement ce que vous consommez, sans abonnement, sans forfait, sans frais mensuels, sans consommation minimale.
Aucun abonnement, aucun forfait, aucuns frais cachés. Rechargez et utilisez immédiatement, votre solde n'expire jamais.
Mode de facturation#
Modèles de texte (facturation au Token)
Élément de facturation
Description
Input Tokens
token consommés en entrée (prompt)
Output Tokens
token consommés en sortie (completion)
Cached Tokens
token d'entrée en cache hit (tarif préférentiel)
Autres modèles
Type
Mode de facturation
Génération d'images
facturation à l'image
Embeddings
facturation aux token d'entrée
Procédure d'utilisation#
- Inscription — rendez-vous sur la console 诺玛AI pour créer un compte
- Recharge — rechargez selon vos besoins, votre solde n'expire jamais
- Appel — facturation selon l'utilisation réelle, règlement en temps réel
Consultation des coûts#
Console
- Connectez-vous à la console 诺玛AI
- Accédez à la page Facture
- Consultez le détail des coûts en temps réel, ventilé par modèle et par date
Réponse de l'API
Chaque réponse de l'API contient un champ `usage`, ce qui facilite le suivi de l'utilisation :
{
"usage": {
"prompt_tokens": 100,
"completion_tokens": 50,
"total_tokens": 150
}
}Conseils d'optimisation des coûts#
- Choisissez le modèle adapté — utilisez un modèle léger pour les tâches simples, inutile de recourir au modèle phare pour tous les cas d'usage
- Activez le Prompt Caching — un system prompt répété permet d'économiser 50 à 90 % du coût d'entrée
- Maîtrisez max_tokens — définissez une limite raisonnable de longueur de sortie pour éviter une consommation inutile de token
- Regroupez les requêtes — fusionnez plusieurs requêtes courtes en une seule pour réduire le coût répété du prompt
Pour la tarification en temps réel de chaque modèle, consultez le catalogue de modèles.
Dernière mise à jour le 23 juin 2026