跳转至

声音复刻

声音复刻是一次性生成流程:用已获授权的参考音频,为输入文字生成新音频。它不创建永久音色档案。

准备事项 要求
账号 登录受邀账号;访客不能提交复刻任务
参考音频 本人或已明确授权、清晰可辨的人声
授权确认 在页面确认对参考声音有使用权限
后端 ChatVoice 能访问兼容的 VoiceClone sidecar
输入 要生成的文字、语言和语速控制

在声音工作室生成

  1. 进入声音工作室,在统一音色卡片中选择“我的复刻声音”。
  2. 上传参考音频,或使用页面提供的录制参考功能。
  3. 确认声音使用授权,在共用文字框填写目标文字。
  4. 按需选择语言和语速,点击生成。
  5. 等待模型加载与合成完成,试听结果,再下载音频。

参考音频在当前会话内可复用。模型冷启动时等待较长;不要连续点击创建重复任务。缺少登录、参考、授权、文字或在线后端时,应查看页面给出的原因。

服务端接入

ChatVoice 不负责安装模型或 GPU 环境。先准备已验证的独立 sidecar,再配置:

CHATVOICE_VOICECLONE_URL=http://127.0.0.1:18187
CHATVOICE_VOICECLONE_TIMEOUT_SECONDS=600

同机使用回环地址;跨主机使用受控内网地址,sidecar 必须监听可达接口。无需把 IndexTTS 安装进 ChatVoice 的 Web 虚拟环境。IndexTTS 2.5 使用独立 Python 3.11 环境和完整模型目录,只有辅助模型并不足够。

兼容 sidecar 提供 /health、创建/查询/删除 /v1/jobs 和任务音频接口。ChatVoice 通过代理增加账号所有权和 CSRF 边界;不要绕过代理把无鉴权 sidecar 暴露给不受控公网。

健康与生成分开验证

状态 含义
configured=false 尚未配置服务地址
status=offline 当前无法访问后端
status=ready、model_loaded=false 服务可达,但模型尚未实际加载
status=ready、model_loaded=true 已加载;仍需实际生成验证

/api/voice-clone/status 是扁平 JSON。上线验收应使用授权测试参考创建真实任务,下载并解码音频;可通过 ASR 复核生成内容,再删除测试任务并确认不可继续读取。

长期服务使用监督器与正常停止策略,检查启用状态、进程和日志。临时会话退出后进程消失,不是重启主网页服务就能修复的。

保留与权限

任务结果仅用于当次试听/下载,不保存生成历史或永久声音库。页面离开和任务过期按生命周期清理;外部下载副本需自行管理。只有任务所属账号能通过 ChatVoice 读取或删除它。

HTTP 接口 · 数据保留 · 离线排查