返回目录
开源项目AI 音频与语音类新手

Audiblez - 从电子书生成有声书

Audiblez 是一个将 EPUB 电子书转换为 M4B 有声书的开源工具,基于 Kokoro-82M 高质量文本转语音模型,支持多种语言、图形界面和 CUDA 加速。

1 次阅读2026/08/11 发布
Audiblez - 从电子书生成有声书 来源图片

社区作者 · zZz

它解决什么问题

Audiblez v4 现已支持图形界面、CUDA 加速和多种语言。该工具使用 Kokoro-82M 文本转语音模型,将普通 EPUB 电子书转换为 .m4b 格式的有声书。Kokoro-82M 是一个仅 82M 参数、发音自然的 TTS 模型,基于 Apache 许可证发布,训练音频不足 100 小时,目前支持美式英语、英式英语、西班牙语、法语、印地语、意大利语、日语、巴西葡萄牙语和中文普通话。

在 Google Colab 的 T4 GPU 上通过 CUDA 转换《动物农场》(约 16 万字符)只需约 5 分钟,转换速度约每秒 600 字符;在 M2 MacBook Pro 的 CPU 上约需 1 小时,速度约每秒 60 字符。项目附带命令行工具和图形界面(GUI)。配图 1 展示了 Audiblez 在 macOS 上的图形界面。

— 本文由 AI 根据公开来源辅助整理,命令、版本与许可证请在使用前到原始页面复核。

安装 / 开始使用

安装命令行工具:

  1. 确保已安装 Python 3、espeak-ng 和 ffmpeg。
  • Ubuntu/Debian:sudo apt install ffmpeg espeak-ng

macOS:

可复制命令
brew install ffmpeg espeak-ng

步骤 2 · 使用 pip 安装:

可复制命令
pip install audiblez
  1. 转换电子书示例:audiblez book.epub -v af_sky
  • 该命令会在当前目录生成 book_chapter_1.wav、book_chapter_2.wav 等临时文件,最后生成 book.m4b 文件(需要已安装 ffmpeg)。

运行图形界面(GUI):

  1. Ubuntu/Debian 需额外安装:sudo apt install libgtk-3-dev(Windows/Mac 不需要)

步骤 2 · 安装 GUI 依赖:

可复制命令
pip install audiblez pillow wxpython
  1. 运行 GUI:audiblez-ui

Windows 安装方法:

  1. 打开 Windows 终端

步骤 2 · 创建新文件夹:

可复制命令
mkdir audiblez

步骤 3 · 进入文件夹:

可复制命令
cd audiblez

步骤 4 · 创建虚拟环境:

可复制命令
python -m venv venv

步骤 5 · 激活虚拟环境:

可复制命令
.\venv\Scripts\Activate.ps1

步骤 6 · 安装依赖:

可复制命令
pip install audiblez pillow wxpython
  1. 现在可以运行 audiblez 或 audiblez-ui
  1. 如需 CUDA 支持,请按 PyTorch 官网安装对应 CUDA 版本的 PyTorch:https://pytorch.org/get-started/locally/

GPU 运行:

默认在 CPU 上运行,传入 --cuda 参数可通过 Torch 使用 CUDA 设备。参考 Google Colab 示例。目前不支持 Apple Silicon(Kokoro 尚无 MLX 实现)。

手动选择章节:

使用 --pick 参数可交互式选择要转换的章节。

帮助页面:

audiblez --help 可查看所有选项,包括 -v/--voice、-p/--pick、-s/--speed、-c/--cuda、-o/--output 等。

来源教程配图

Audiblez GUI on MacOSX
配图 1 · Audiblez GUI on MacOSX查看原图

适用场景

将 EPUB 电子书转换为 M4B 有声书
为电子书选择不同语言和性别的配音
在本地或 GPU 上批量生成有声书
通过 -s 参数调整朗读速度
使用 --pick 手动选择需要朗读的章节
Audiblez - 从电子书生成有声书 · Aitroys Hub