加载本地模型
POST /v1/models/load
加载已下载的模型,并在服务所在机器上分配内存。本地语言模型必须先加载,才能用于语言生成或 Realtime。
请求体
application/json必填
modelstring必填清单里的模型 ID。响应
200模型已加载。返回里还可能出现与运行机器相关的字段。successbooleanmodelstringstatusstring{
"success": true,
"model": "Qwen/Qwen3.5-4B",
"status": "loaded"
}400请求不合法。先改请求再重试:error.code 用于程序判断,error.param 用于定位是哪个输入。401API Key 缺失或无效。403Host 或 Origin 不被允许,或 License 被拒。按 error.code 区分这两种情况。503所需的本地模型仍在准备(model_downloading),或服务正忙(service_busy)。带 Retry-After 时按它退避。