模型与 Provider API

Provider API 配置工作流、知识库和 Agent 在 AI Studio 内部使用的模型后端,不用于 执行 OpenAI 兼容推理。自有应用使用 Genesis API Key 调用模型时,请使用 模型 API

Provider 类型

产品契约区分三类 Provider:

类型

根路径

典型用途

LLM

/newmoi/llm

生成、推理、抽取与 Agent 对话

Embedding

/newmoi/embedding

为知识库与检索生成向量

Parser

/newmoi/parser

把支持的文档转换为可处理内容

每个启用的 Provider 类型都可以暴露 Backend、Backend 详情、Endpoint、Endpoint 状态与 Router 配置。LLM 和 Embedding 还提供模型发现与探测操作。

Backend 与 Endpoint

LLM Backend 的主要接口如下:

方法与路径

用途

GET /newmoi/llm/backends

列出已配置 Backend

POST /newmoi/llm/backends

创建 Backend

GET /newmoi/llm/backends/:id

读取 Backend

PUT /newmoi/llm/backends/:id

更新 Backend

DELETE /newmoi/llm/backends/:id

删除 Backend

POST .../:id/endpoints

创建 Endpoint

GET .../:id/endpoints

列出 Backend Endpoint

PUT .../:endpoint_id/status

修改 Endpoint 状态

POST .../:id/probe-models

通过该 Backend 探测模型

Embedding 与 Parser 在各自根路径下使用相同的资源模式,但字段随 Provider 类型变化。 例如 Parser 可以声明支持的 MIME 类型,模型 Provider 则可以包含模型 ID 和凭据引用。 即使路径结构相似,也不能在不同 Provider 类型间直接复制字段,必须按部署 Schema 调用。

启用 Endpoint 前先执行 Probe。Probe 成功只能证明提交的连接在当时可用,不能保证后续 可用性、模型额度、向量维度兼容性或所有工作区用户都有权限。

Router 与可用模型

GETPUT /newmoi/{family}/router 用于读取与更新路由配置。LLM 和 Embedding 模型列表分别位于 /newmoi/models/newmoi/embedding/models;Family 或 Backend 级也提供 Probe 接口。

Router 策略及字段由部署环境定义。只能使用同一工作区接口返回的 Backend 和 Endpoint ID 更新 Router。更新后重新读取 Router,并完成一次有代表性的 Probe,再切换生产流量。

初始配置与密钥

POST /newmoi/llm/setup 是 LLM Backend 的产品级初始化操作,可能编排多个底层创建 步骤。部署环境提供该流程说明时,应优先使用它。

Provider API Key 与凭据属于密钥,只能放在契约明确标记的凭据字段中,不能返回给 浏览器,也不能期待列表或详情接口显示明文。轮换 Provider Key 可能同时影响 Agent、 工作流和知识索引;修改前应盘点使用者并保留回滚信息。

删除 Backend 或停用最后一个健康 Endpoint 可能中断正在运行的任务。操作前检查健康 状态与下游绑定,并确认影响范围。工作流内出现模型错误时,应把 Provider Probe 与 workflow execution ID 对照排查,而不是反复重跑任务。

最后更新于