声音复刻¶
声音复刻是一次性生成流程:用已获授权的参考音频,为输入文字生成新音频。它不创建永久音色档案。
| 准备事项 | 要求 |
|---|---|
| 账号 | 登录受邀账号;访客不能提交复刻任务 |
| 参考音频 | 本人或已明确授权、清晰可辨的人声 |
| 授权确认 | 在页面确认对参考声音有使用权限 |
| 后端 | ChatVoice 能访问兼容的 VoiceClone sidecar |
| 输入 | 要生成的文字、语言和语速控制 |
在声音工作室生成¶
- 进入声音工作室,在统一音色卡片中选择“我的复刻声音”。
- 上传参考音频,或使用页面提供的录制参考功能。
- 确认声音使用授权,在共用文字框填写目标文字。
- 按需选择语言和语速,点击生成。
- 等待模型加载与合成完成,试听结果,再下载音频。
参考音频在当前会话内可复用。模型冷启动时等待较长;不要连续点击创建重复任务。缺少登录、参考、授权、文字或在线后端时,应查看页面给出的原因。
服务端接入¶
ChatVoice 不负责安装模型或 GPU 环境。先准备已验证的独立 sidecar,再配置:
同机使用回环地址;跨主机使用受控内网地址,sidecar 必须监听可达接口。无需把 IndexTTS 安装进 ChatVoice 的 Web 虚拟环境。IndexTTS 2.5 使用独立 Python 3.11 环境和完整模型目录,只有辅助模型并不足够。
兼容 sidecar 提供 /health、创建/查询/删除 /v1/jobs 和任务音频接口。ChatVoice 通过代理增加账号所有权和 CSRF 边界;不要绕过代理把无鉴权 sidecar 暴露给不受控公网。
健康与生成分开验证¶
| 状态 | 含义 |
|---|---|
configured=false |
尚未配置服务地址 |
status=offline |
当前无法访问后端 |
status=ready、model_loaded=false |
服务可达,但模型尚未实际加载 |
status=ready、model_loaded=true |
已加载;仍需实际生成验证 |
/api/voice-clone/status 是扁平 JSON。上线验收应使用授权测试参考创建真实任务,下载并解码音频;可通过 ASR 复核生成内容,再删除测试任务并确认不可继续读取。
长期服务使用监督器与正常停止策略,检查启用状态、进程和日志。临时会话退出后进程消失,不是重启主网页服务就能修复的。
保留与权限¶
任务结果仅用于当次试听/下载,不保存生成历史或永久声音库。页面离开和任务过期按生命周期清理;外部下载副本需自行管理。只有任务所属账号能通过 ChatVoice 读取或删除它。