Skip to content

模型列表

可用模型以控制台和 /v1/models 返回为准。不同账号的开通范围可能不同。需要判断模型是否支持图片输入、图片生成或视频生成时,使用 /v1/model-catalog

模型广场与开通范围

控制台的“模型广场”用于给当前租户开通模型。模型开通是租户级别的,同一租户下的用户和 API Key 共享这份开通范围。

最终能被某个 API Key 看到并调用的模型,是以下条件的交集:

  • 平台当前启用且可路由的模型。
  • 当前租户已经在模型广场开通的模型。
  • 当前 API Key 允许调用的模型范围。
  • 平台模型策略没有隐藏或禁用的模型。

如果控制台在线体验或 /v1/models 没有返回模型,请先到模型广场开通模型;如果模型已经开通但仍不可见,请检查 API Key 是否设置了模型限制。

查询模型

bash
curl https://llm.xiaoyue9527.xyz/v1/models \
  -H 'Authorization: Bearer sk-gtw-REPLACE_ME'

返回示例:

json
{
  "object": "list",
  "data": [
    {
      "id": "qwen3.6-plus",
      "object": "model",
      "owned_by": "Qwen"
    }
  ]
}

查询单个模型

bash
curl https://llm.xiaoyue9527.xyz/v1/models/qwen3.6-plus \
  -H 'Authorization: Bearer sk-gtw-REPLACE_ME'

返回示例:

json
{
  "id": "qwen3.6-plus",
  "object": "model",
  "created": 1778238628,
  "owned_by": "Qwen"
}

查询模型能力

bash
curl https://llm.xiaoyue9527.xyz/v1/model-catalog \
  -H 'Authorization: Bearer sk-gtw-REPLACE_ME'

返回示例:

json
{
  "object": "list",
  "data": [
    {
      "model_id": "qwen3.6-plus",
      "display_name": "Qwen3.6 Plus",
      "group": "Qwen",
      "modalities": {
        "input": ["text", "image"],
        "output": ["text"]
      },
      "tasks": ["t2t", "i2t"],
      "features": ["streaming", "reasoning", "tool_calling", "vision"],
      "badges": ["文本/对话模型", "推理", "工具调用", "视觉理解", "多模态"]
    }
  ]
}

查询单个模型能力

bash
curl https://llm.xiaoyue9527.xyz/v1/model-catalog/qwen3.6-plus \
  -H 'Authorization: Bearer sk-gtw-REPLACE_ME'

返回该模型的 modalitiestasksfeaturesbadges 等能力字段,结构同列表中的单个元素。调用前可用它判断模型是否支持图片输入(modalities.inputimage)等。

视频模型还会返回 task_type: "video"video 能力合同。例如:

json
{
  "model_id": "seedance-2-0-fast",
  "task_type": "video",
  "modalities": {
    "input": ["text", "image", "video"],
    "output": ["video"]
  },
  "tasks": ["t2v", "i2v", "v2v"],
  "video": {
    "schema_version": 1,
    "task_modes": ["t2v", "i2v", "v2v"],
    "input_media_types": ["image", "video"],
    "output_resolutions": ["480p", "720p"],
    "default_resolution": "720p",
    "output_fps": 24,
    "aspect_ratios": ["16:9", "9:16", "1:1"],
    "min_duration_seconds": 4,
    "max_duration_seconds": 15,
    "max_input_video_seconds": 15,
    "max_input_media": 1,
    "result_url_temporary": true,
    "supports_cancel": true
  }
}

能力以接口实时返回为准,不同视频模型的输入媒体、分辨率、时长和素材数量可能不同。 视频模型采用任务维度价格规则,不应把为空的文本输入/输出 Token 价格理解为免费; 当前客户价格以控制台模型广场展示为准。

常见 tasks 含义:

task含义
t2t文本对话
i2t图片理解
t2i文生图
i2i图生图
t2v文生视频
i2v图生视频
v2v视频生成视频
a2v音频驱动视频
multi_reference多参考素材视频生成
embedding文本向量化
rerank文档重排序

常用模型

以下为常见模型 ID 示例,实际可用范围以账号开通为准。

模型 ID说明
qwen3.6-plus通用文本
qwen3.5-plus通用文本
text-embedding-v4文本向量化,通过 /v1/embeddings 调用
qwen3-rerank文本重排序,通过 /v1/rerank 调用
qwen3-vl-rerank多模态重排序,通过 /v1/rerank 调用
deepseek-v4-proDeepSeek V4 Pro,高质量文本、代码和推理场景
deepseek-v4-flashDeepSeek V4 Flash,低延迟文本和在线交互场景
seedance-2-0-fast异步视频生成,通过 /v1/video/generations/tasks 调用

模型 ID 大小写敏感。请求时请使用 /v1/models 返回的完整 ID。

可见模型与开通范围

/v1/models 返回的是当前 API Key 可调用、可展示的模型列表。不同账号、不同 API Key 的开通范围可能不同,因此不要把文档中的示例模型写死为唯一来源。

/v1/model-catalog 返回模型能力信息,适合在客户端展示模型分组、模态、任务类型、上下文长度和能力标签。实际发起调用前,仍建议以 /v1/models 的返回结果作为最终可用列表。

/v1/models/v1/model-catalog 的可见模型集合相同(都受 API Key 范围、租户开通、模型策略过滤),区别仅在于 /v1/model-catalog 额外返回 modalities/tasks/features/badges 能力字段;两者都不会列出未开通的模型。

模型广场用于发现和开通模型;/v1/models 用于客户端运行时判断当前 Key 实际可调用的模型。生产代码应以后者为准。

OpenAI-compatible API documentation.