ebook2audiobook — 您的个人AI有声书工厂
您上一次没有足够时间阅读心爱的书是什么时候?或者您是否想在慢跑时听技术文档?ebook2audiobook项目让这些梦想成为现实——支持1100+语言和语音克隆功能。
这是什么工具?
ebook2audiobook是一个开源Python解决方案,使用现代文本转语音(TTS)模型从电子格式创建有声书。它在后台运行强大的引擎,包括:
- XTTSv2
- Bark
- VITS
- Fairseq
- YourTTS
- Tacotron

核心功能
- 支持1100+语言 — 从英语到稀有方言
- 语音克隆 — 可以使用您自己的声音进行朗读
- 自动章节分割 — 保留书籍结构
- 多种输出格式 — MP3、M4B、FLAC等
- 即使在低端硬件上也能运行 — 最低要求4GB内存
实际使用效果如何?
安装很简单——支持所有操作系统:
git clone https://github.com/DrewThomasson/ebook2audiobook.git
cd ebook2audiobook
./ebook2audiobook.sh # Для Linux/Mac
或者更简单的方式——通过Docker:
docker run --pull always --rm -p 7860:7860 athomasson2/ebook2audiobook
启动后,您打开Web界面上传EPUB、PDF或其他支持的格式的书籍,选择设置——稍等片刻即可获得一个现成的有声书。
谁会特别需要它?
- 开发者 — 用来听文档
- 学生 — 随时随地学习材料
- 作家 — 从外部聆听自己的文字
- 视力障碍人士 — 以音频格式获取书籍
- 多语言学习者 — 支持大量语言
技术特点
该项目正在积极开发中——已经具备:
- GPU支持,处理速度更快
- 语音参数微调
- 与Google Colab和Kaggle集成
- Docker Compose支持
ebook2audiobook是最先进的开源文本转语音工具之一。如果您一直想创建自己的音频库,或者在寻找一种在旅途中"阅读"书籍的方式——绝对值得一试。
该项目正在积极开发中,已在GitHub上获得超过1万颗星。加入Discord社区,立即开始创建您的有声书!
相关项目