配置 LLM 模型服务

使用 AI Studio SDK 在指定工作区中创建一个 LLM 模型服务及其首个地址。创建成功后,服务端返回模型服务和地址;保存它们的 ID,供后续读取或调整。

任务流程

  1. 准备模型服务名称、非空服务地址和至少一个模型名称。

  2. 在目标工作区中提交创建请求。

  3. 保存服务端返回的模型服务 ID 和首个地址 ID,继续管理配置或路由。

准备

需要的内容

在本页中的作用

已绑定目标工作区的客户端上下文

确定模型服务所属的工作区。

模型服务名称

创建一个模型服务。

非空服务地址和至少一个模型名称

创建首个地址并描述可用模型。

访问密钥(如服务需要)

随创建请求交给模型服务。

创建模型服务和首个地址

本步骤创建 LLM 模型服务和首个地址。创建请求返回不代表模型推理已经验证;它仅提供后续读取和调整配置所需的服务端标识。

workspace, err := client.Workspace(workspaceID)
if err != nil {
	return err
}

backend, result, err := workspace.SetupLLMBackend(
	ctx,
	"example-llm",
	modelServiceURL,
	[]string{modelName},
	sdk.WithProviderBackendAPIKey(modelServiceAPIKey),
)
if err != nil {
	return err
}

_ = backend
_ = result
workspace = client.workspace(workspace_id)

backend, result = workspace.setup_llm_backend(
    "example-llm",
    model_service_url,
    [model_name],
    sdk.with_provider_backend_api_key(model_service_api_key),
)

print(result.backend.id, result.endpoint.id)

结果确认

保存返回的模型服务 ID 和地址 ID。地址探测和已创建模型服务上的模型探测返回候选模型信息;两者不会创建模型服务。

限制

  • 地址探测只适用于 LLM 和 Embedding 模型服务;Parser 模型服务不支持地址探测。

  • 不要将密钥写入代码、日志或错误信息。

下一步

最后更新于