加载本地模型

POST /v1/models/load

加载已下载的模型,并在服务所在机器上分配内存。本地语言模型必须先加载,才能用于语言生成或 Realtime。

指南与示例模型与服务全部接口

请求体

application/json必填

modelstring必填清单里的模型 ID。

响应

200模型已加载。返回里还可能出现与运行机器相关的字段。
successboolean
modelstring
statusstringloaded | unloaded
JSON
{
  "success": true,
  "model": "Qwen/Qwen3.5-4B",
  "status": "loaded"
}
400请求不合法。先改请求再重试:error.code 用于程序判断,error.param 用于定位是哪个输入。
401API Key 缺失或无效。
403Host 或 Origin 不被允许,或 License 被拒。按 error.code 区分这两种情况。
503所需的本地模型仍在准备(model_downloading),或服务正忙(service_busy)。带 Retry-After 时按它退避。