创建可复用的用户音色

POST /v1/audio/voices

用一段短参考音频和它的文稿,在服务所在机器的声音库里保存一个可复用的音色。不要传 model。用返回的 voice.id 做播报生成或删除。

指南与示例播报与声音库全部接口

请求体

multipart/form-data必填

audio_samplefile必填必填的参考音频,最大 10 MiB。用一段干净的短音频。
ref_textstring必填参考音频对应的文稿。
namestring必填音色的显示名称,会出现在返回的 names 里。
consentboolean必填必填:true。true
languagestring参考音频的语言,例如 zh-CN 或 en-US。不传则按 zh-CN 保存。见 /docs/languages#by-api 。默认 "zh-CN"
speaker_descriptionstring可选的说话人描述,会出现在返回的 descriptions 里。

响应

200创建出的音色。选播报模型前先看它的兼容性。
successboolean
voiceobject一条音色记录。名称和描述是按语言的映射,不是单个名字字符串。
idstring音色 ID,例如 builtin:bright-girl 或 user:<uuid>。
namesobject
descriptionsobject
supported_languagesstring[]
originstring例如 cloned。
compatibilityobject[]按模型给出的兼容性。可用不等于对每个播报模型都兼容。
availableboolean
created_by_userboolean只有用户音色能删除,内置音色不可修改。
JSON
{
  "success": true,
  "voice": {
    "id": "user:00000000-0000-4000-8000-000000000001",
    "names": {
      "en-US": "My voice"
    },
    "descriptions": {},
    "supported_languages": [
      "en-US"
    ],
    "origin": "cloned",
    "compatibility": [],
    "available": true,
    "created_by_user": true
  }
}
400请求不合法。先改请求再重试:error.code 用于程序判断,error.param 用于定位是哪个输入。
401API Key 缺失或无效。
403Host 或 Origin 不被允许,或 License 被拒。按 error.code 区分这两种情况。
413请求体超过 512 MiB。
503所需的本地模型仍在准备(model_downloading),或服务正忙(service_busy)。带 Retry-After 时按它退避。