模型目录

诺玛AI 提供主流大模型的统一访问。你可以在 诺玛AI 模型目录 浏览所有可用模型,也可以通过 Models API 以编程方式获取完整模型信息。

模型命名规范#

所有模型遵循 `provider/model-name` 格式:

代码
anthropic/claude-sonnet-4.6
google/gemini-pro-compatible-flash-lite-preview
moonshotai/kimi-k2.5

Models API 标准#

诺玛AI 的 Models API 遵循 OpenRouter 标准,以 JSON 格式返回每个模型的完整元数据。

API 响应结构

代码
{
  "object": "list",
  "data": [
    /* Model 对象数组 */
  ]
}

每个模型包含以下标准化字段:

字段

类型

说明

`id`

string

API 请求中使用的模型标识符,如 `"anthropic/claude-sonnet-4.6"`

`canonical_slug`

string

模型的永久标识符,不会变更

`name`

string

模型的显示名称

`created`

number

模型添加时间(Unix 时间戳)

`description`

string

模型能力和特性的详细说明

`context_length`

number

最大上下文窗口大小(token 数)

`architecture`

Architecture

模型技术架构信息

`pricing`

Pricing

模型定价信息

`top_provider`

TopProvider

主要供应商配置

`supported_parameters`

string[]

支持的 API 参数列表

描述模型的输入/输出模态和分词器信息:

字段

说明

`modality`

输入输出模态的简写,如 `text+image->text`

`input_modalities`

支持的输入类型:`text`、`image`、`audio`、`file`

`output_modalities`

支持的输出类型:`text`

`tokenizer`

分词器类型

`instruct_type`

指令格式类型(部分模型为 `null`)

所有价格以 美元/token 为单位。值为 `"0"` 表示免费。

字段

说明

`prompt`

输入 token 单价

`completion`

输出 token 单价

`input_cache_read`

缓存读取 token 单价

`input_cache_write_5m`

5 分钟缓存写入 token 单价

`input_cache_write_1h`

1 小时缓存写入 token 单价

不同模型的分词方式不同,即使输入和输出相同,token 数量(和费用)也会有所差异。请使用响应中的 `usage` 字段获取实际 token 消耗。

字段

说明

`context_length`

供应商级别的上下文限制

`max_completion_tokens`

单次响应最大 token 数

`is_moderated`

是否启用内容审核

`supported_parameters` 数组标识了该模型支持的 OpenAI 兼容参数:

参数

说明

`temperature`

采样温度控制

`top_p`

核采样参数

`max_tokens`

最大响应长度

`stop`

自定义停止序列

`tools`

函数调用 / Tool Use

`tool_choice`

工具选择策略

`response_format`

输出格式规范(JSON Mode)

`reasoning`

深度推理模式

获取模型列表#

Models API 是公开接口,无需 API Key 即可调用。

cURL

代码
curl https://as.apinoma.com/v1/models

Python

TypeScript

查看完整的实时模型列表和定价,请访问 诺玛AI 模型目录 。 如需查看实时模型能力,请以控制台模型广场展示为准。

最后更新于 2026年6月23日