创建可复用的用户音色
POST /v1/audio/voices
用一段短参考音频和它的文稿,在服务所在机器的声音库里保存一个可复用的音色。不要传 model。用返回的 voice.id 做播报生成或删除。
请求体
multipart/form-data必填
audio_samplefile必填必填的参考音频,最大 10 MiB。用一段干净的短音频。ref_textstring必填参考音频对应的文稿。namestring必填音色的显示名称,会出现在返回的 names 里。consentboolean必填必填:true。speaker_descriptionstring可选的说话人描述,会出现在返回的 descriptions 里。响应
200创建出的音色。选播报模型前先看它的兼容性。successbooleanvoiceobject一条音色记录。名称和描述是按语言的映射,不是单个名字字符串。idstring音色 ID,例如 builtin:bright-girl 或 user:<uuid>。namesobjectdescriptionsobjectsupported_languagesstring[]originstring例如 cloned。compatibilityobject[]按模型给出的兼容性。可用不等于对每个播报模型都兼容。availablebooleancreated_by_userboolean只有用户音色能删除,内置音色不可修改。{
"success": true,
"voice": {
"id": "user:00000000-0000-4000-8000-000000000001",
"names": {
"en-US": "My voice"
},
"descriptions": {},
"supported_languages": [
"en-US"
],
"origin": "cloned",
"compatibility": [],
"available": true,
"created_by_user": true
}
}400请求不合法。先改请求再重试:error.code 用于程序判断,error.param 用于定位是哪个输入。401API Key 缺失或无效。403Host 或 Origin 不被允许,或 License 被拒。按 error.code 区分这两种情况。413请求体超过 512 MiB。503所需的本地模型仍在准备(model_downloading),或服务正忙(service_busy)。带 Retry-After 时按它退避。