# 选择模型与能力

选择模型的结果是一个用于 API 请求 `model` 字段的模型 ID。通过 `GET /models` 为应用筛选当前凭证可调用的模型；如需在控制台中比较模型类型、能力、上下文、价格和状态，请参阅 Genesis 指南的[模型广场](../../../../guides/genesis/models.md)。模型广场不保存单独的“已选模型”配置；完成本页后，应获得一个已经验证可调用的模型 ID。

## 选择路径

| 使用场景 | 建议路径 | 结果 |
| --- | --- | --- |
| 首次了解和比较模型 | 在[模型广场](../../../../guides/genesis/models.md)中筛选并查看模型详情 | 复制候选模型的模型 ID。 |
| 在应用中自动选择或检查可用性 | 调用 [获取可用模型](available-models.md) 中的 `GET /models` | 从当前凭证可访问的列表中选出模型 ID。 |

两条路径都应在实际调用前完成最小请求验证。模型广场中的信息有助于比较；`GET /models` 的结果用于确认当前凭证实际可以调用哪些模型。

## 按任务选择模型类型

| 要完成的任务 | 优先选择的模型类型 | 后续调用入口 |
| --- | --- | --- |
| 根据文本生成或续写回复 | 文本对话 | [文本对话](../openai-compatible/chat-completions/text-chat.md) |
| 根据文本和图像生成回复 | 多模态对话 | [多模态对话](../openai-compatible/chat-completions/multimodal-chat.md) |
| 将文本或图文内容转换为向量 | 文本或多模态 Embeddings | [Embeddings](../retrieval-vector/embeddings.md) |
| 按查询意图为候选内容重新排序 | 文本或多模态 Rerank | [Rerank](../retrieval-vector/rerank.md) |

模型目录还可能显示 OCR、图像、视频、TTS 和 ASR 等类型。模型出现在目录中不表示已经提供对应的独立公开推理接口；当前没有对应指南时，不要根据模型类型推测请求路径或请求体。

## 区分模型类型和支持能力

模型类型说明模型适合处理的主要任务。支持能力说明模型是否支持视觉输入、Responses、Messages 或其他调用形态。同一模型类型中的模型不一定支持相同的参数、输入格式、上下文长度或流式行为。

对话模型除了 Chat Completions 外，还可能支持 Responses 或 Messages。仅当模型详情或模型目录显示对应能力，并且最小请求验证成功时，才使用相应接口。

## 为 API 调用选择模型

应用需要按当前凭证的可访问范围选型时，先调用 `GET /models`。根据返回的模型 ID 及当前响应中可用的类型、能力信息筛选候选模型，再使用目标接口发送最小请求。

| 选择条件 | 需要确认的内容 |
| --- | --- |
| 任务类型 | 模型适用于对话、向量化还是重排序。 |
| 输入和调用形态 | 是否需要图像输入、Responses 或 Messages。 |
| 上下文和输出 | 模型详情中的上下文窗口和最大输出是否满足请求。 |
| 成本和状态 | 模型详情中的价格和状态是否符合使用要求。 |
| 可调用性 | 模型 ID 是否出现在当前 `GET /models` 响应中。 |

如果应用需要预设备选模型，备选模型也应使用相同的调用形态，并单独验证输入格式、可选参数和响应处理。名称相近或来自同一 Provider 的模型不一定可以直接替换。

## 验证选择结果

1. 将模型 ID 填入目标接口的 `model` 字段。
2. 使用目标场景的最小输入发送请求。
3. 检查响应是否包含预期结果；流式调用还需要确认客户端可以处理增量事件和结束事件。
4. 记录实际使用的模型 ID，便于在结果、用量或错误排查时定位调用。

模型目录发生变化时，重新查询 `GET /models` 并验证候选模型。不要在模型从当前响应中消失后继续假定它可用。

## 下一步

- [获取可用模型](available-models.md)
- [文本对话](../openai-compatible/chat-completions/text-chat.md)
- [Chat Completions 流式输出](../openai-compatible/chat-completions/streaming-chat-completions.md)
