OPEN-SOURCE TOOLS

真正有实用价值的 GitHub 开源工具

按股票分析、量化交易、数字货币、视频增强、图片增强等方向筛选项目,标明仓库、许可证、安装门槛与适用场景。

正在查看标签 #音频处理清除筛选
Audiblez - 从电子书生成有声书 阅览图
开源项目 · AI 音频与语音类
开源
开源项目·AI 音频与语音类·新手

Audiblez - 从电子书生成有声书

Audiblez 是一个将 EPUB 电子书转换为 M4B 有声书的开源工具,基于 Kokoro-82M 高质量文本转语音模型,支持多种语言、图形界面和 CUDA 加速。

GitHub 开源项目

1 阅读2026/08/11
查看指南
GitHub - OpenBMB/VoxCPM: VoxCPM2: Tokenizer-Free TTS for Multilingual Speech Generation, Creative Voice Design, and True-to-Life Cloning 阅览图
开源项目 · AI 音频与语音类
开源
开源项目·AI 音频与语音类·新手

GitHub - OpenBMB/VoxCPM: VoxCPM2: Tokenizer-Free TTS for Multilingual Speech Generation, Creative Voice Design, and True-to-Life Cloning

VoxCPM2: Tokenizer-Free TTS for Multilingual Speech Generation, Creative Voice Design, and True-to-Life Cloning English | 中文 👋 Join our community for discussion and support! Feishu | Discord VoxCPM is a tokenizer-free Text-to-Speech system that directly

GitHub 开源项目

0 阅读2026/08/10
查看指南
MiniMax H3 Audio T8 - ComfyUI 原生 H3 音频节点扩展 阅览图
开源项目 · AI 音频与语音类
开源
开源项目·AI 音频与语音类·新手

MiniMax H3 Audio T8 - ComfyUI 原生 H3 音频节点扩展

面向 ComfyUI 原生 MiniMax H3 的扩展节点包,当前 1.12.0 注册 54 个节点,覆盖音画条件、对白分析、长视频续写、语音链、来源视频音画重绘等实验与稳定功能。代码采用 GPL-3.0-or-later,不包含模型权重,需配合 ComfyUI 及 MiniMax H3 模型使用。

GitHub 开源项目

0 阅读2026/08/10
查看指南