电子书变成能听的有声书:ebook2audiobook 完整攻略

电子书变成能听的有声书:ebook2audiobook 完整攻略 电子书变成能听的有声书ebook2audiobook 完整攻略【免费下载链接】ebook2audiobookGenerate audiobooks from e-books, voice cloning 1158 languages!项目地址: https://gitcode.com/GitHub_Trending/eb/ebook2audiobook通勤路上想听手机里那本小说结果有声书资源要么没有要么音色机械。其实还有条更省事的路把手里的电子书自己转成有声书再塞进耳机里。这件事就是 ebook2audiobook 干的。它是一个开源的电子书转有声书工具丢一本电子书进去吐出来的是一份带章节、带元数据的完整有声书。几个关键数字支持1158种语言主流和小语种都覆盖能读20多种电子书格式EPUB、MOBI、PDF、TXT1 GB显存VRAM就是显卡自带的运行内存起步2 GB内存也够跑语音克隆只需 1 到 5 分钟的音频样本带背景音也没关系从拖入电子书到拿到有声书的全流程 第一次跑起来就两行命令不用手动装依赖启动脚本会自己处理环境。# 克隆项目到本地 git clone https://gitcode.com/GitHub_Trending/eb/ebook2audiobook cd ebook2audiobook# macOS / LinuxWindows 直接双击 ebook2audiobook.cmd ./ebook2audiobook.command终端会打印出 localhost:7860 的链接浏览器自动弹出。首次运行要下载语音模型等几分钟正常。想跳过界面批量转换也可以# 无头模式整文件夹批量转换语言用 ISO 代码 ./ebook2audiobook.command --headless --ebooks_dir ./my_books --language eng 它怎么把书变成声音输入、合成、输出三段一句话看完整流程先把文字读出来再合成语音最后打包成有声书文件。输入端20 多种格式扫描件有 OCR 兜底EPUB、MOBI、PDF、TXT、HTML、DOCX 都能进JPG、PNG、BMP 这类图片也行。扫描版 PDF 没有文字层内置的 OCR光学字符识别说白了就是从图片里认字会先把文字读出来再进入合成。扫描页也能靠 OCR 认出文字合成端多套 TTS 引擎各偏一种风格TTS文本转语音是全部的核心。它挂了 XTTSv2、Bark、VITS、YourTTS、Tacotron2、Fairseq 等多套引擎实现都在 lib/classes/tts_engines/。长篇叙事选 XTTSv2多语言且稳Bark 能带情感和语气变化VITS、YourTTS、Tacotron2 偏轻量CPU 上也能跑出可用速度音色质量低半档。输出端默认 M4B章节自动保留默认产出 M4B有声书专用格式能存章节标记和元数据EPUB 和 MOBI 输入时章节结构会自动保留。也可以换 MP3、FLAC、WAV 等声道选单声道或立体声。想让停顿更讲究还能在文本里插 SML 标签控制暂停和换声音见 components/E2A-SML。 跟做一遍拖书、选参数、转换、拿文件从拖进去到拿到文件一共 4 步。第 1 步把书拖进去。把 EPUB 拖进上传框。想让结果听起来像你再往声音样本位放一段 1 到 5 分钟的录音WAV 或 MP3 都行。它会自动给样本降噪录的时候放背景音乐也无所谓这就是语音克隆部分。只想先试音色把一小段文字贴进文本框单独转换就行不用整本书。输入区电子书与声音样本第 2 步选参数。在书的下方选目标语言、合成引擎和计算设备CPU 或 GPU。用 GPU 就确认显卡支持 CUDA。合成参数语言、引擎、设备第 3 步点 Convert。进度条随合成段落推进。中途想停点上传框里的 X 就行。第 4 步拿文件。完成后下方区域会列出生成的有声书带播放器先在线试听确认没问题再下载。完成的有声书可试听可下载️ 调音手册3 个真正影响听感的旋钮三个都在高级设置区别被其他选项吓到。温度控制合成发挥的幅度。默认值已经稳叙事听着有点平淡就按 0.1 一档往上加加过头语调会夸张再往回收。语速默认接近正常语速。技术文档、信息密度高的内容可以调快一些助眠、慢速跟听就调慢。文本分割开启后先把长文本切段再合成避免一句长文直接翻车。官方承认它效率偏低短文本没必要开。 适合谁你的机器跑得动吗用得最多的是三类人想把文档转成通勤听书的人想给视障朋友读书的人要给播客、视频批量生成旁白或练外语听力的人。档位内存显存最低2 GB1 GB推荐8 GB4 GB支持 CUDA只有 CPU 也能转但建议挑 VITS、Tacotron2 这类轻引擎现代大引擎在 CPU 上会慢得明显。⚠️ 三个高频坑速查GPU 认不出来多半是驱动或框架版本不匹配。先跑仓库根目录的 detect_gpus.py 自检或者直接用 Docker 跑环境完全隔离。CPU 转得太慢新引擎在 CPU 上本来就慢换轻引擎或给机器配上 GPU差距是数量级的。个别句子被截断小语种的句子切分规则还在调优。先开文本分割再试一次反复出现就去项目 issue 反馈作者需要母语者帮忙修切分逻辑。手机里那本书现在已经在耳机里了。下次通勤按一下播放键眼睛就可以休息了。【免费下载链接】ebook2audiobookGenerate audiobooks from e-books, voice cloning 1158 languages!项目地址: https://gitcode.com/GitHub_Trending/eb/ebook2audiobook创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考