选择模型与能力¶
选择模型的结果是一个用于 API 请求 model 字段的模型 ID。通过 GET /models 为应用筛选当前凭证可调用的模型;如需在控制台中比较模型类型、能力、上下文、价格和状态,请参阅 Genesis 指南的模型广场。模型广场不保存单独的“已选模型”配置;完成本页后,应获得一个已经验证可调用的模型 ID。
选择路径¶
使用场景 |
建议路径 |
结果 |
|---|---|---|
首次了解和比较模型 |
在模型广场中筛选并查看模型详情 |
复制候选模型的模型 ID。 |
在应用中自动选择或检查可用性 |
调用 获取可用模型 中的 |
从当前凭证可访问的列表中选出模型 ID。 |
两条路径都应在实际调用前完成最小请求验证。模型广场中的信息有助于比较;GET /models 的结果用于确认当前凭证实际可以调用哪些模型。
按任务选择模型类型¶
要完成的任务 |
优先选择的模型类型 |
后续调用入口 |
|---|---|---|
根据文本生成或续写回复 |
文本对话 |
|
根据文本和图像生成回复 |
多模态对话 |
|
将文本或图文内容转换为向量 |
文本或多模态 Embeddings |
|
按查询意图为候选内容重新排序 |
文本或多模态 Rerank |
模型目录还可能显示 OCR、图像、视频、TTS 和 ASR 等类型。模型出现在目录中不表示已经提供对应的独立公开推理接口;当前没有对应指南时,不要根据模型类型推测请求路径或请求体。
区分模型类型和支持能力¶
模型类型说明模型适合处理的主要任务。支持能力说明模型是否支持视觉输入、Responses、Messages 或其他调用形态。同一模型类型中的模型不一定支持相同的参数、输入格式、上下文长度或流式行为。
对话模型除了 Chat Completions 外,还可能支持 Responses 或 Messages。仅当模型详情或模型目录显示对应能力,并且最小请求验证成功时,才使用相应接口。
为 API 调用选择模型¶
应用需要按当前凭证的可访问范围选型时,先调用 GET /models。根据返回的模型 ID 及当前响应中可用的类型、能力信息筛选候选模型,再使用目标接口发送最小请求。
选择条件 |
需要确认的内容 |
|---|---|
任务类型 |
模型适用于对话、向量化还是重排序。 |
输入和调用形态 |
是否需要图像输入、Responses 或 Messages。 |
上下文和输出 |
模型详情中的上下文窗口和最大输出是否满足请求。 |
成本和状态 |
模型详情中的价格和状态是否符合使用要求。 |
可调用性 |
模型 ID 是否出现在当前 |
如果应用需要预设备选模型,备选模型也应使用相同的调用形态,并单独验证输入格式、可选参数和响应处理。名称相近或来自同一 Provider 的模型不一定可以直接替换。
验证选择结果¶
将模型 ID 填入目标接口的
model字段。使用目标场景的最小输入发送请求。
检查响应是否包含预期结果;流式调用还需要确认客户端可以处理增量事件和结束事件。
记录实际使用的模型 ID,便于在结果、用量或错误排查时定位调用。
模型目录发生变化时,重新查询 GET /models 并验证候选模型。不要在模型从当前响应中消失后继续假定它可用。