查询可调用模型¶
查询当前凭据可见且已启用的 Genesis 模型,获取调用标识、能力和价格。模型列表用于发现模型,不保证每个模型都支持所有同类型调用接口。
GET https://token.moi.matrixorigin.cn/v1/models
调用前准备¶
准备用于 Genesis 调用的个人访问令牌或服务账号 API Key。创建和权限配置参阅管理 Genesis 访问凭据。
查询参数¶
将 $GENESIS_ACCESS_TOKEN 替换为个人访问令牌或服务账号 API Key。
curl -G "https://token.moi.matrixorigin.cn/v1/models" \
-H "Authorization: Bearer $GENESIS_ACCESS_TOKEN" \
--data-urlencode "type=chat"
参数 |
类型 |
是否必填 |
说明 |
|---|---|---|---|
|
string |
否 |
按模型类型筛选: |
成功响应¶
成功时返回当前凭据可见且已启用的模型列表及模型信息。模型是否支持具体调用接口,还取决于 capabilities 和当前可用的模型路由。
下方价格仅用于说明响应格式,实际价格以所选模型返回的值为准。
{
"object": "list",
"data": [
{
"id": "$MODEL_ID",
"object": "model",
"type": "chat",
"sub_type": "text",
"capabilities": [
"multi_turn",
"messages"
],
"pricing": {
"pricing_mode": "retail",
"input_price_per_million": "0.50",
"output_price_per_million": "1.50",
"currency": "USD"
},
"created": 1780000000,
"owned_by": "taas"
}
]
}
字段 |
类型 |
说明 |
|---|---|---|
|
string |
固定为 |
|
array of object |
筛选后当前凭据可见且已启用的模型。列表中的模型不一定支持所有同类型调用接口。 |
|
string |
模型调用标识,填入推理请求的 |
|
string |
固定为 |
|
string |
模型类型: |
|
string |
输入子类型: |
|
array of string |
模型能力标签。 |
|
object |
模型价格。单价使用十进制字符串;各单价字段可能省略。 |
|
string |
价格来源; |
|
string |
每百万输入 Token 的价格。 |
|
string |
每百万输出 Token 的价格。 |
|
string |
每百万缓存写入 Token 的价格。 |
|
string |
每百万缓存命中 Token 的价格。 |
|
string |
OCR 每页价格。 |
|
string |
图像每张价格。 |
|
string |
高清图像每张价格。 |
|
string |
视频每秒价格。 |
|
string |
高清视频每秒价格。 |
|
string |
语音合成每万字符价格。 |
|
string |
高清语音合成每万字符价格。 |
|
string |
语音识别每分钟价格。 |
|
string |
实时语音识别每分钟价格。 |
|
string |
上述价格的币种,例如 |
|
integer |
模型创建时间,Unix 秒级时间戳。 |
|
string |
模型归属标记,返回 |
错误响应¶
未提供有效凭据时返回 HTTP 401。检查访问凭据是否有效,并在请求中携带认证信息。
{
"error": {
"message": "Invalid or missing TaaS API key",
"type": "invalid_api_key",
"code": "invalid_api_key"
}
}
字段 |
类型 |
说明 |
|---|---|---|
|
object |
错误信息。 |
|
string |
凭据缺失或无效的说明。 |
|
string |
错误类别。 |
|
string |
错误代码。 |
后续操作¶
将 data[].id 作为 model 传入推理请求。按目标接口选择模型:
Messages:选择
capabilities包含messages的模型。Responses:选择
capabilities包含responses的模型。Embeddings 和 Rerank:根据对应的
embedding.*或rerank.*标签选择输入类型。Chat Completions:先使用
type=chat缩小模型范围。当前模型列表不提供 Chat Completions 专用能力标签;如果调用返回endpoint_capability_mismatch,请选择其他chat模型。