Danh mục mô hình

诺玛AI cung cấp quyền truy cập thống nhất tới các mô hình lớn phổ biến. Bạn có thể duyệt tất cả mô hình khả dụng trong danh mục mô hình 诺玛AI, hoặc lấy thông tin mô hình đầy đủ theo cách lập trình thông qua Models API.

Quy ước đặt tên mô hình#

Tất cả mô hình tuân theo định dạng `provider/model-name`:

anthropic/claude-sonnet-4.6
google/gemini-pro-compatible-flash-lite-preview
moonshotai/kimi-k2.5

Tiêu chuẩn Models API#

Models API của 诺玛AI tuân theo tiêu chuẩn OpenRouter, trả về siêu dữ liệu đầy đủ của mỗi mô hình ở định dạng JSON.

Cấu trúc phản hồi API

{
  "object": "list",
  "data": [
    /* Mảng đối tượng Model */
  ]
}

Mỗi mô hình bao gồm các trường chuẩn hóa sau:

Trường

Kiểu

Mô tả

`id`

string

Mã định danh mô hình dùng trong yêu cầu API, ví dụ `"anthropic/claude-sonnet-4.6"`

`canonical_slug`

string

Mã định danh vĩnh viễn của mô hình, không thay đổi

`name`

string

Tên hiển thị của mô hình

`created`

number

Thời điểm thêm mô hình (dấu thời gian Unix)

`description`

string

Mô tả chi tiết về khả năng và đặc điểm của mô hình

`context_length`

number

Kích thước cửa sổ ngữ cảnh tối đa (số token)

`architecture`

Architecture

Thông tin kiến trúc kỹ thuật của mô hình

`pricing`

Pricing

Thông tin định giá của mô hình

`top_provider`

TopProvider

Cấu hình nhà cung cấp chính

`supported_parameters`

string[]

Danh sách tham số API được hỗ trợ

Mô tả thông tin về phương thức đầu vào/đầu ra và bộ phân tách token của mô hình:

Trường

Mô tả

`modality`

Dạng viết tắt của phương thức đầu vào/đầu ra, ví dụ `text+image->text`

`input_modalities`

Các loại đầu vào được hỗ trợ: `text`, `image`, `audio`, `file`

`output_modalities`

Các loại đầu ra được hỗ trợ: `text`

`tokenizer`

Loại bộ phân tách token

`instruct_type`

Loại định dạng chỉ thị (một số mô hình là `null`)

Tất cả giá tính theo đơn vị đô la Mỹ/token. Giá trị `"0"` nghĩa là miễn phí.

Trường

Mô tả

`prompt`

Đơn giá token đầu vào

`completion`

Đơn giá token đầu ra

`input_cache_read`

Đơn giá token đọc từ bộ nhớ đệm

`input_cache_write_5m`

Đơn giá token ghi vào bộ nhớ đệm 5 phút

`input_cache_write_1h`

Đơn giá token ghi vào bộ nhớ đệm 1 giờ

Các mô hình khác nhau phân tách token theo cách khác nhau, ngay cả khi đầu vào và đầu ra giống nhau thì số lượng token (và chi phí) cũng có thể chênh lệch. Vui lòng dùng trường `usage` trong phản hồi để lấy mức tiêu thụ token thực tế.

Trường

Mô tả

`context_length`

Giới hạn ngữ cảnh ở cấp nhà cung cấp

`max_completion_tokens`

Số token tối đa cho mỗi phản hồi

`is_moderated`

Có bật kiểm duyệt nội dung hay không

Mảng `supported_parameters` cho biết các tham số tương thích OpenAI mà mô hình này hỗ trợ:

Tham số

Mô tả

`temperature`

Kiểm soát nhiệt độ lấy mẫu

`top_p`

Tham số lấy mẫu hạt nhân

`max_tokens`

Độ dài phản hồi tối đa

`stop`

Chuỗi dừng tùy chỉnh

`tools`

Gọi hàm / Tool Use

`tool_choice`

Chiến lược chọn công cụ

`response_format`

Đặc tả định dạng đầu ra (JSON Mode)

`reasoning`

Chế độ suy luận sâu

Lấy danh sách mô hình#

Models API là giao diện công khai, có thể gọi mà không cần API Key.

cURL

curl https://as.apinoma.com/v1/models

Python

TypeScript

Để xem danh sách mô hình và bảng giá đầy đủ theo thời gian thực, vui lòng truy cập danh mục mô hình 诺玛AI. Nếu cần xem khả năng mô hình theo thời gian thực, vui lòng lấy thông tin hiển thị tại quảng trường mô hình của bảng điều khiển làm chuẩn.

Cập nhật lần cuối vào 23 tháng 6, 2026