
把 epub 变成 m4bebook2audiobook 从上手到批量生产的实操教程【免费下载链接】ebook2audiobookGenerate audiobooks from e-books, voice cloning 1158 languages!项目地址: https://gitcode.com/GitHub_Trending/eb/ebook2audiobook周末翻完一本 epub第二天通勤却更想听。ebook2audiobook简称 E2A就是干这件事的开源电子书转有声书工具把整本书切成分段交给 TTS 引擎朗读再合成一个带章节标记、元数据的 m4b 或 mp3 文件全程支持 1158 种语言和方言也能用你自己的声音克隆朗读。 它到底做什么、不做什么E2A 的定位是一个CPU/GPU 电子书转有声书转换器输入 epub、pdf、txt 等电子书文件输出带章节和元数据的音频文件并保留 SML 标签[pause]、[voice:...]这类控制停顿和换声的标记。它不处理 DRM 保护的电子书也不做内容编辑——epub 本身没有标准的章节/序言结构转换前需要自己删掉不想被朗读的部分比如版权页和目录。 第一次上手从克隆仓库到听到第一句朗读先确认硬件最低 2GB 内存、1GB 显存推荐 8GB 内存、4GB 显存没有显卡也能跑只是慢。接着你打开终端克隆仓库并进入目录git clone https://gitcode.com/GitHub_Trending/eb/ebook2audiobook cd ebook2audiobook然后按系统跑启动脚本Linux/macOS 执行./ebook2audiobook.commandWindows 执行ebook2audiobook.cmd也可以直接双击。脚本会自动创建虚拟环境、装齐依赖全程不需要你手动pip install。终端最后会打印一条本地地址你访问http://localhost:7860在界面里拖入电子书、选语言、点 Convert生成的 m4b 出现在底部的 Audiobooks 列表里可以直接试听下载 按你要完成的事来用换一种语言念出来项目内置 1158 种语言和方言界面下拉框直接选命令行用--language传 ISO-639-3 代码中文 zho、法语 fra、德语 deu两字母代码也认。如果书本身不是目标语言还可以用--translate先把整本书翻译成另一种语言再合成。用自己的声音朗读上传一段 1~5 分钟的清晰人声作克隆样本有背景噪音也不怕它会自动降噪处理。内置音色库以英语为主其他语言推荐自己录一段参考音频。挑一个顺耳的引擎默认引擎是 XTTSv2另有 Bark、VITS、Fairseq、Tacotron2、YourTTS、Tortoise、GlowTTS、Piper 可选命令行--tts_engine参数切换引擎需要与所选语言兼容选错会报错。从 epub 到 m4b 的格式链路输入支持 epub、pdf、mobi、txt、html、rtf 等二十多种格式输出 m4b、mp3、flac、wav、ogg、aac 等十种音频格式。m4b 自带章节标记适合有声书播放器epub 和 mobi 的自动章节识别效果最好。⚡ 让流程更顺的进阶手段如果你有一批书要转用--ebooks_dir指一个目录就能批量转换还能配--voice_map给不同文件指定不同音色长任务中断后加--session加会话 ID 可以从断点继续会话 ID 就显示在 Web 界面的 Session 框里。如果你有 NVIDIA 显卡启动时选 GPU 设备CUDA 或 ROCm转换接近实时Mac 用 MPS纯 CPU 机器则换 YourTTS、Tacotron2 这类轻量引擎慢但能跑。如果你本地根本没有 GPU仓库自带 Google Colab Notebook 和 Kaggle 版云端跑完再取回文件。如果你的电子书其实是扫描版 PDF 或图片开 OCR 扫描即可支持 PDF、JPG、PNG、TIFF、BMP。想做出更贴近真人播读的节奏可以看 XTTSv2 微调训练脚本用几段音频训练自己的专属音色。 容易卡住的几个点GPU 没被识别 → 多为驱动或 CUDA 版本不匹配按仓库 wiki 的 GPU 排查清单过一遍。装依赖一路报错 → 别和系统 Python 硬刚用自带的 Docker 镜像环境完全自包含。音频中途截断、句子念到一半停了 → 是句切分逻辑对个别语言适配不够到仓库提 issue维护者靠用户反馈修这类问题。启动时提示 7860 端口已被占用 → 上一次的 Web 界面还开着先关掉旧进程再启动。 谁会在什么情况下用到它一位初中英语老师把整本教材转成 mp3按章节分发给学生听力课直接放音频。图书馆的无障碍专员把馆藏 epub 批量转成 m4b章节标记让视障读者在播放器里直接跳章。播客主播录了段三分钟的自己的声音当克隆样本整本书用同一音色读完听众完全听不出换书了。工具只适用于非 DRM 保护、合法获取的电子书请遵守版权法规。转换前备份原文件、优先用 epub、克隆样本尽量干净——这三点决定了最终成品的下限。去仓库仓库里把最新版本跑起来你的第一本有声书离得并不远。【免费下载链接】ebook2audiobookGenerate audiobooks from e-books, voice cloning 1158 languages!项目地址: https://gitcode.com/GitHub_Trending/eb/ebook2audiobook创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考