Fish Speech
在 Clore.ai 的 GPU 上运行 Fish Speech 多语言 TTS 和零样本声音克隆
服务器要求
参数
最低要求
推荐配置
在 CLORE.AI 上快速部署
1. 找到合适的服务器
2. 配置您的部署
3. 访问界面
逐步设置
第一步:SSH 登录到您的服务器
步骤 2:拉取并运行 Docker 容器
步骤 3:验证 GPU 访问
步骤 4:检查模型下载
步骤 5:访问 WebUI
步骤 6:(可选)启用 API 服务器
使用示例
示例 1:通过 WebUI 的基础文本转语音
示例 2:零样本语音克隆
示例 3:基于 API 的 TTS(Python)
示例 4:多语言 TTS
示例 5:批量处理音频文件
invokeai.yaml 配置文件
Docker Compose(生产部署)
关键配置选项
选项
默认
描述
模型变体
模型
大小
语言
说明
1. 使用 SDXL-Turbo 或 SDXL-Lightning 以实现快速生成
1. 启用 torch.compile 以加速推理
2. 使用半精度(FP16)
3. 预加载参考语音
4. GPU 内存优化
5. 批量大小调整
故障排除
问题:容器无法启动 — 找不到 CUDA
问题:内存不足(OOM)错误
问题:端口 7860 无法访问
问题:模型下载失败 / 下载缓慢
问题:音频质量差
问题:WebUI 加载但生成过程挂起
文档
Clore.ai 的 GPU 建议
在 Clore.ai 上的预估费用
开发/测试
RTX 3090(24GB)
最后更新于
这有帮助吗?