MeloTTS 多语言语音合成从克隆仓库到合成第一句音频的完整指南【免费下载链接】MeloTTSHigh-quality multi-lingual text-to-speech library by MyShell.ai. Support English, Spanish, French, Chinese, Japanese and Korean.项目地址: https://gitcode.com/GitHub_Trending/me/MeloTTSMeloTTS 是 MyShell.ai 开源的多语言文本转语音TTS即把文字变成语音库支持英语含美式、英式、印度、澳洲 5 种口音、中文、西班牙语、法语、日语和韩语CPU 即可实时推理。适合需要给产品加语音、做多语言内容或者只是想快速把一段文字读出来的人。本文按任务拆解先跑通第一条音频再选一种日常用法最后教你调音色语速和排查报错。一、先跑通本地安装并合成第一条语音前置条件Ubuntu 20.04 或 macOSPython 3.9。纯 CPU 就能实时合成有 NVIDIA GPUCUDA只是更快。克隆仓库并安装pip install -e .会以可编辑模式安装依赖git clone https://gitcode.com/GitHub_Trending/me/MeloTTS.git cd MeloTTS pip install -e . python -m unidic download最后一条命令下载日语发音所需的 Unidic 词典资源。安装成功的标志是终端能直接敲出melo命令。装好后用命令行合成第一条音频melo Hello, this is my first synthesis first.wav预期结果当前目录出现first.wav播放器打开时长约 1 秒。到这里环境就算跑通了。二、Windows 或 macOS 装不动时走 DockermacOS 原生安装偶尔会报依赖错误Windows 建议直接用 Docker一条命令就能避开全部兼容性问题。在项目目录里构建镜像首次构建要几分钟docker build -t melotts .然后启动容器把本机 8888 端口映射进去docker run -it -p 8888:8888 melotts有 GPU 的机器加上--gpus all参数启用加速。预期结果浏览器打开http://localhost:8888能看到 Web 界面。三、按场景选一种日常用法三种入口按需选不必全用1. 只想点开就用的Web 界面。安装完成后运行melo-ui界面里能切换语言和声音适合快速试听对比。2. 要在脚本或批处理里用的CLI。核心格式是文本 输出路径 可选参数melo text-to-speech 领域近年来发展迅速 zh.wav -l ZH melo file.txt out.wav --file第二条是把整个文本文件读进来合成。不想背参数时melo --help能列出全部选项。3. 要集成到自己程序里的Python API。最小可用示例from melo.api import TTS model TTS(languageZH, deviceauto) # auto有 GPU 用 GPU否则用 CPU speaker_ids model.hps.data.spk2id model.tts_to_file(中文和英文可以混着读, speaker_ids[ZH], zh.wav, speed1.0)换语言只改language参数EN/ES/FR/JP/KR各语言完整写法见 docs/install.md。想基于自己的语料训练新音色可以看 docs/training.md。四、调整发音人和语速让声音贴合场景⚠️ 发音人参数只对英语生效其他语言各只有一个默认发音人。英语可选 5 个发音人EN-Default、EN-US美式、EN-BR英式、EN_INDIA印度口音、EN-AU澳洲口音。CLI 里这样组合melo Text to read out.wav --language EN --speaker EN-US --speed 1.5语速默认 1.0建议控制在 0.52.0 之间超出范围音质会下降。中文发音人支持中英混排文本不需要单独处理英文单词。效果不满意时先换发音人再调语速这两个因素影响最大。五、出问题怎么查按报错现象对号入座安装时报依赖冲突优先用虚拟环境隔离或直接换上面的 Docker 路线。melo命令找不到说明pip install -e .没执行成功重跑一次并检查 pip 是否指向当前 Python 环境。合成时报empty textCLI 会拒绝空文本检查引号内是否真的有空字符或文件是否为空。日语合成报缺资源补跑python -m unidic download。音质听感不佳多为参数问题按上一节换发音人、把语速拉回 1.0 附近再试听。源码都在 melo/ 目录下排查行为时可以对照melo/main.py的 CLI 参数定义。现在就打开终端跑一条melo 你好 test.wav -l ZH把中文第一条音频合成出来。【免费下载链接】MeloTTSHigh-quality multi-lingual text-to-speech library by MyShell.ai. Support English, Spanish, French, Chinese, Japanese and Korean.项目地址: https://gitcode.com/GitHub_Trending/me/MeloTTS创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
