选择模型与能力

选择模型的结果是一个用于 API 请求 model 字段的模型 ID。通过 GET /models 为应用筛选当前凭证可调用的模型;如需在控制台中比较模型类型、能力、上下文、价格和状态,请参阅 Genesis 指南的模型广场。模型广场不保存单独的“已选模型”配置;完成本页后,应获得一个已经验证可调用的模型 ID。

选择路径

使用场景

建议路径

结果

首次了解和比较模型

模型广场中筛选并查看模型详情

复制候选模型的模型 ID。

在应用中自动选择或检查可用性

调用 获取可用模型 中的 GET /models

从当前凭证可访问的列表中选出模型 ID。

两条路径都应在实际调用前完成最小请求验证。模型广场中的信息有助于比较;GET /models 的结果用于确认当前凭证实际可以调用哪些模型。

按任务选择模型类型

要完成的任务

优先选择的模型类型

后续调用入口

根据文本生成或续写回复

文本对话

文本对话

根据文本和图像生成回复

多模态对话

多模态对话

将文本或图文内容转换为向量

文本或多模态 Embeddings

Embeddings

按查询意图为候选内容重新排序

文本或多模态 Rerank

Rerank

模型目录还可能显示 OCR、图像、视频、TTS 和 ASR 等类型。模型出现在目录中不表示已经提供对应的独立公开推理接口;当前没有对应指南时,不要根据模型类型推测请求路径或请求体。

区分模型类型和支持能力

模型类型说明模型适合处理的主要任务。支持能力说明模型是否支持视觉输入、Responses、Messages 或其他调用形态。同一模型类型中的模型不一定支持相同的参数、输入格式、上下文长度或流式行为。

对话模型除了 Chat Completions 外,还可能支持 Responses 或 Messages。仅当模型详情或模型目录显示对应能力,并且最小请求验证成功时,才使用相应接口。

为 API 调用选择模型

应用需要按当前凭证的可访问范围选型时,先调用 GET /models。根据返回的模型 ID 及当前响应中可用的类型、能力信息筛选候选模型,再使用目标接口发送最小请求。

选择条件

需要确认的内容

任务类型

模型适用于对话、向量化还是重排序。

输入和调用形态

是否需要图像输入、Responses 或 Messages。

上下文和输出

模型详情中的上下文窗口和最大输出是否满足请求。

成本和状态

模型详情中的价格和状态是否符合使用要求。

可调用性

模型 ID 是否出现在当前 GET /models 响应中。

如果应用需要预设备选模型,备选模型也应使用相同的调用形态,并单独验证输入格式、可选参数和响应处理。名称相近或来自同一 Provider 的模型不一定可以直接替换。

验证选择结果

  1. 将模型 ID 填入目标接口的 model 字段。

  2. 使用目标场景的最小输入发送请求。

  3. 检查响应是否包含预期结果;流式调用还需要确认客户端可以处理增量事件和结束事件。

  4. 记录实际使用的模型 ID,便于在结果、用量或错误排查时定位调用。

模型目录发生变化时,重新查询 GET /models 并验证候选模型。不要在模型从当前响应中消失后继续假定它可用。

下一步

最后更新于