拓冰建站拓冰建站
首页 / 资讯中心 / 正文

3 条命令完成电子书转有声书:ebook2audiobook 上手

3 条命令完成电子书转有声书ebook2audiobook 上手【免费下载链接】ebook2audiobookGenerate audiobooks from e-books, voice cloning 1158 languages!项目地址: https://gitcode.com/GitHub_Trending/eb/ebook2audiobook每天通勤 40 分钟想把待读书单变成可以听的内容——这是 ebook2audiobookE2A要解决的场景。它是一个 CPU/GPU 通用的电子书转有声书工具把 EPUB、MOBI、PDF、TXT 等 20 多种格式的电子文件送入 TTS 引擎朗读输出带章节标记的音频文件。工具支持 1158 种语言内置 XTTSv2、Bark、VITS、Tacotron2 等 8 种 TTS 引擎可选用也支持用几秒录音做零样本语音克隆。硬件门槛不高2 GB 内存、1 GB 显存即可运行8 GB 内存、4 GB 显存体验更佳。从零到可运行本地安装依赖并启动 TTS 转换环境安装脚本会自动检测操作系统、架构与 GPU 环境并配置好 Python 依赖不需要手动建虚拟环境git clone https://gitcode.com/GitHub_Trending/eb/ebook2audiobook cd ebook2audiobook ./ebook2audiobook.command # Windows 用户运行 ebook2audiobook.cmd启动后终端会打印http://localhost:7860/浏览器打开即进入 Gradio 图形界面同一入口加--headless参数则跳过界面直接在终端完成转换两者共用同一套参数体系。核心操作路径一次完整的电子书转有声书流程打开 Web 界面后整个转换按以下顺序进行在 Dashboard 页签上传电子书。EPUB 和 MOBI 的章节结构最完整自动章节检测效果最好PDF 为纯图片扫描件时会自动走 OCR 流程。在语言选择器中指定电子书语言编码为 ISO-639-3如eng、spa、zho工具会据此选择默认 TTS 引擎。配置语音内置默认语音开箱即用想要个性化音色时上传一段数秒的干净人声录音触发语音克隆工具会对参考音频自动降噪。选择计算设备。GPU 可用时选 CUDA/MPS可获得接近实时的合成速度纯 CPU 环境建议换轻量引擎具体见参数部分。点击转换按钮进度按章节推进。完成后页面直接提供音频片段预览与下载。图 1ebook2audiobook 电子书转有声书主界面展示文件上传与基础设置区域参数与调优低配设备 TTS 省资源方案与输出格式选择参数按使用场景分组理解更直接。日常听书平衡档温度值 0.6–0.7语速保持 1.0重复惩罚约 2.5抑制语句重复长书开启文本分割避免单句过长导致截断输出 m4b 单声道自带章节标记低配设备省资源CPU 为主引擎换 YourTTS 或 Tacotron2CPU 上速度明显更快调低 top_k / top_p 采样值生成速度提升输出 mp3体积小、播放端无压力追求音质GPU 可用XTTSv2 搭配 CUDA参考音频质量越高克隆越像温度值降到 0.5 附近朗读节奏更稳定输出 flac 或 wav保留无损细节格式体积兼容性建议用途m4b中有声书播放器原生支持章节长篇小说、教材默认mp3小几乎所有设备手机日常聆听flac大主流播放器与 PC 端归档、二次剪辑wav很大通用专业后期处理图 2音频生成参数设置界面可调节温度、语速与采样参数批量与进阶命令行无头模式批量转换电子书需要处理多本电子书时无头模式更合适。--ebooks_dir指向一个目录即可整批转换--voice指定克隆音色配合--voice_map可以为每本书分配不同声音# 单本转换指定电子书、语言与输出格式 ./ebook2audiobook.command --headless --ebook /path/to/book.epub --language eng --output_format m4b # 批量转换目录内全部电子书使用克隆音色 ./ebook2audiobook.command --headless --ebooks_dir /path/to/books --language spa --voice /path/to/voice.wav --output_format mp3--device、--tts_engine、--temperature等参数与界面选项一一对应完整列表运行--help即可查看无需额外记忆。排障速查转换慢、显存不足与 GPU 检测失败的处理现象可能原因处理方式转换速度慢CPU 上运行重型模型如 XTTSv2有独立显卡时通过--device启用 CUDA/MPS纯 CPU 环境改用 YourTTS、Tacotron2 等轻量引擎GPU 未被检测到驱动或 PyTorch 后端与显卡不匹配查看启动时终端打印的 GPU 检测输出按提示安装对应后端或用 Docker 模式获得自包含环境音频截断、断句位置不准该语言的句子分割逻辑覆盖不足提交问题并附上样本文本维护者依赖用户样本调优分割逻辑依赖安装失败、环境冲突本地 Python 版本或与预装库冲突使用--script_mode build_docker构建容器运行依赖完全隔离转换完成后音频文件写入输出目录默认为audiobooks/m4b 等格式可直接导入支持章节标记的有声书播放器。【免费下载链接】ebook2audiobookGenerate audiobooks from e-books, voice cloning 1158 languages!项目地址: https://gitcode.com/GitHub_Trending/eb/ebook2audiobook创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
分享:

看完干货,该让你的企业上线了

免费需求沟通 · 48 小时内出具建站方案 · 河南本地可上门