简单、快速、强大的语音克隆服务
支持流式语音生成,实时返回音频数据,提供流畅的用户体验。
首次运行自动下载和加载模型,无需手动配置。模型缓存到容器内部,支持 Docker 部署。
提供直观的 HTTP GET 接口,只需传递文本参数即可生成语音,易于集成到任何应用。
提供 GPU 和 CPU 两种 Docker 部署方案,一键启动,快速部署到生产环境。
支持下载和使用自定义参考音色,让语音克隆效果更加个性化和专业。
基于成熟的 F5 TTS 模型和 FastAPI 框架,确保服务稳定性和高可用性。
三步即可启动语音克隆服务
下载预制的参考音色文件到项目目录:
chmod +x scripts/download_maker_tts.shsh scripts/download_maker_tts.sh
使用 Docker 快速启动 API 服务:
docker compose -f docker/docker-compose-gpu.yml-p f5ttsapi up -d --build
访问 API 端点生成语音:
curl "http://localhost:17781/infer?gen_text=你好,欢迎使用语音克隆服务"
快速找到您关心问题的答案
gen_text - 要生成的文本内容(必需)seed - 随机种子,控制生成的一致性stream - 是否使用流式输出(1=是,0=否)refresh - 是否刷新模型(1=是,0=否)