Hướng dẫn tính phí
诺玛AI áp dụng mô hình trả phí theo mức sử dụng thuần túy — dùng bao nhiêu trả bấy nhiêu, không đăng ký thuê bao, không gói cước, không phí hàng tháng, không mức chi tiêu tối thiểu.
Không thuê bao, không gói cước, không phí ẩn. Nạp tiền là dùng được ngay, số dư không bao giờ hết hạn.
Cách tính phí#
Mô hình văn bản (tính phí theo Token)
Hạng mục tính phí
Mô tả
Input Tokens
Token tiêu thụ cho đầu vào (prompt)
Output Tokens
Token tiêu thụ cho đầu ra (completion)
Cached Tokens
Token đầu vào trúng bộ nhớ đệm (giá ưu đãi)
Các mô hình khác
Loại
Cách tính phí
Tạo ảnh
Tính phí theo số ảnh
Embeddings
Tính phí theo token đầu vào
Quy trình sử dụng#
- Đăng ký — Truy cập bảng điều khiển 诺玛AI để đăng ký tài khoản
- Nạp tiền — Nạp theo nhu cầu, số dư không bao giờ hết hạn
- Gọi API — Trừ phí theo mức sử dụng thực tế, quyết toán theo thời gian thực
Xem chi phí#
Bảng điều khiển
- Đăng nhập bảng điều khiển 诺玛AI
- Vào trang Hóa đơn
- Xem chi tiết chi phí theo thời gian thực, thống kê theo mô hình và theo ngày
Phản hồi API
Mỗi phản hồi API đều chứa trường `usage`, thuận tiện cho việc theo dõi mức sử dụng:
{
"usage": {
"prompt_tokens": 100,
"completion_tokens": 50,
"total_tokens": 150
}
}Gợi ý tối ưu chi phí#
- Chọn mô hình phù hợp — Tác vụ đơn giản dùng mô hình nhẹ, không cần dùng mô hình hàng đầu cho mọi tình huống
- Bật Prompt Caching — System prompt lặp lại có thể tiết kiệm 50-90% chi phí đầu vào
- Kiểm soát max_tokens — Đặt giới hạn độ dài đầu ra hợp lý, tránh tiêu thụ token không cần thiết
- Gộp yêu cầu — Gộp nhiều yêu cầu ngắn thành một, giảm chi phí prompt lặp lại
Giá theo thời gian thực của từng mô hình, vui lòng xem Danh mục mô hình.
Cập nhật lần cuối vào 23 tháng 6, 2026