abogen 快速上手指南3 步把 EPUB 变成带同步字幕的有声书【免费下载链接】abogenGenerate audiobooks from EPUBs, PDFs and text with synchronized captions.项目地址: https://gitcode.com/GitHub_Trending/ab/abogen想做一部有声书或给课程视频配上逐句同步字幕最省事的办法是直接用 abogen 做文本转语音丢一个文件进去它就生成有声书音频同时产出时间轴精确对齐的字幕文件。下面按装好→跑通→按需加料的顺序带你走一遍。先跑起来安装与启动安装推荐用 uv一行搞定uv tool install --python 3.12 abogen依赖里还需要 espeak-ngWindows 用户可以直接运行仓库里的WINDOWS_INSTALL.bat一键装齐。装好后有两条启动路径桌面版终端执行abogen打开 PyQt 界面Web 版执行abogen-web浏览器访问localhost:8808Web 版功能更全多模型、LLM 文本规整、Audiobookshelf 推送等新手建议从 Web 版入手。首次运行会自动下载 TTS 模型和语音包之后可以离线使用。实战演示上传文件到出片真实操作顺序第 1 步上传文件把文件拖进页面或点上传按钮。EPUB、PDF、TXT、Markdown甚至 SRT/ASS/VTT 字幕文件都认。EPUB 和 PDF 还能按章节或页码范围勾选只转你需要的部分。第 2 步配置参数语速0.1x 到 2.0x 之间调音色语言代号性别选比如a是美音、m男声拿不准就先点语音试听字幕粒度按行、整句、或每 1~3 个词一条随视频风格选输出格式WAV、FLAC、MP3、OPUS想要带章节标记的 M4B 就选它混音单一音色不满意时打开语音混合器给多个语音模型分别设权重调出想要的听感第 3 步排队并出结果点Create job任务立刻进入队列。队列按顺序逐个处理每个文件保留入队时的参数互不串扰。完成后直接在页面下载音频和字幕。参考演示中约 3000 字文本在消费级显卡上十几秒就能产出 3 分多钟音频。进阶技巧按需上手语音配置文件调好的混合比例可存成 profile下次一键套用也能整体导出、分享给别人GPU 加速有 NVIDIA 显卡的话安装时选[cuda]扩展如uv tool install abogen[cuda]转换速度明显提升AMD 显卡走 ROCmWindows 上暂不支持批量处理用队列一次塞入多个文件各自保留独立配置也可勾选用当前配置覆盖队列项统一强制同一套参数谁会用得上教育课程讲义、课件批量配音字幕与语音逐句对齐直接压进视频小说朗读整本 EPUB 转成带章节的 M4B 有声书可按章拆分或合并播客与短视频口播稿快速出配音和 SRT 字幕改稿后重跑成本很低更多细节可以看 README.md 和 docs/getting-started.md。第一次生成不太满意调个参数重新入队就行abogen 把生成有声书这件事做到了几分钟内出结果。【免费下载链接】abogenGenerate audiobooks from EPUBs, PDFs and text with synchronized captions.项目地址: https://gitcode.com/GitHub_Trending/ab/abogen创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
