MoneyPrinterTurbo:一站式 AI 短视频生成工具
MoneyPrinterTurbo 是一个基于 AI 大模型和自动化工作流的开源短视频生成工具。用户只需提供视频主题或关键词,即可自动生成视频脚本、匹配素材、生成字幕和背景音乐,并合成高清短视频。项目支持 AI Agent、WebUI、API 和 CLI 四种使用方式,提供多种 API 服务和语音合成选项,并可一键发布到 TikTok、Instagram 和 YouTube Shorts。
社区作者 · Aitroys 管理员
它解决什么问题
MoneyPrinterTurbo 是一站式 AI 短视频生成工具。只需提供视频主题或关键词,即可自动生成视频脚本、匹配素材、生成字幕和背景音乐,并合成高清短视频。
功能特性包括:AI Agent、WebUI、API 和 CLI 四种使用方式;AI 自动生成或自定义脚本;支持竖屏 9:16(1080x1920)和横屏 16:9(1920x1080);批量视频生成;视频片段时长设置;多语言脚本生成;多种语音合成(Edge TTS、Azure Speech、SiliconFlow、Google Gemini、小米 MiMo、ElevenLabs、Chatterbox);字幕生成(字体、位置、颜色、大小、描边和背景样式可调);背景音乐(随机或指定,可调音量);本地素材或从 Pexels、Pixabay、Coverr 获取免费高清素材;支持 Kimi/Moonshot AI、OpenAI、Google Gemini、DeepSeek、阿里云通义千问、Azure OpenAI、火山引擎方舟、xAI Grok、MiniMax、小米 MiMo 等模型服务,兼容 Cloudflare AI Gateway、魔搭 ModelScope、AIHubMix、AIML API、EvoLink、Ollama、OneAPI、LiteLLM、Groq、Pollinations AI 等网关与本地环境;生成完成后可自动上传至 TikTok、Instagram 和 YouTube Shorts。
界面预览见配图 1(WebUI)、配图 2(API)。作品示例包括竖屏和横屏视频。配置要求建议 Windows 10、macOS 11.0 或更高版本、主流 Linux 发行版,Python 3.11 或更高版本,CPU 4 核以上,内存 4 GB 以上,GPU 非必需。快速开始支持 AI Agent、Google Colab、Windows 一键启动包。部署方式包括 Docker 和手动部署。语音合成默认 Edge TTS,字幕生成支持 edge 和 whisper 两种模式。
项目还感谢了 Kimi、火山引擎、CCSub、Cubence、0029 云桥、二狗 API、录咖 AI、佐糖等赞助商。
— 本文由 AI 根据公开来源辅助整理,命令、版本与许可证请在使用前到原始页面复核。
安装 / 开始使用
一、AI Agent 方式
如果 AI Agent 支持读取 Skill 文档并操作本地终端,可直接发送:'使用这个 Skill:https://raw.githubusercontent.com/harry0703/MoneyPrinterTurbo/main/docs/skill/SKILL.md 帮我生成一个主题为“人工智能如何改变普通人的日常生活”的视频。' Agent 会自动完成安装、配置和视频生成,只有缺少必要 API Key 时才会询问,完成后返回视频文件路径。支持 macOS 和 Windows。
二、Windows 一键启动包
下载最新版 https://github.com/harry0703/MoneyPrinterTurbo/releases/latest ,解压(路径不要有中文、特殊字符、空格),先双击 update.bat 更新到最新代码,再双击 start.bat 启动。启动后自动打开浏览器,若空白建议用 Chrome 或 Edge。
三、Docker 部署
- 安装 Docker Desktop(Windows 用户参考微软 WSL 文档);
步骤 2
cd MoneyPrinterTurbo && docker compose -f docker-compose.release.yml up(默认拉取 ghcr.io/harry0703/moneyprinterturbo:latest 预构建镜像);
- 首次启动前将 config.example.toml 复制为 config.toml 供容器挂载;
- WebUI 访问 http://127.0.0.1:8501 ;
- API 文档访问 http://127.0.0.1:8080/docs 或 /redoc。
四、手动部署
- 前提:Python 3.11 或更高版本,Windows 路径避免中文、特殊字符、空格。
步骤 2
git clone https://github.com/harry0703/MoneyPrinterTurbo.git && cd MoneyPrinterTurbo。
步骤 3 · 创建虚拟环境(推荐 uv):
uv python install 3.11 && uv sync --frozen;或 venv+ pip:
python3.11 -m venv .venv && source .venv/bin/activate && pip install -r requirements.txt。
步骤 4 · 启动 WebUI:Windows 执行
.\webui.bat,macOS/Linux 执行
sh webui.sh;允许局域网访问可先执行
set MPT_WEBUI_HOST=0.0.0.0(Windows)或
MPT_WEBUI_HOST=0.0.0.0 sh webui.sh。启动后自动打开浏览器。
步骤 5 · 启动 API 服务:
uv run python main.py或
python main.py(已激活虚拟环境)。
步骤 6 · 纯命令行方式:
uv run python cli.py --video-subject "人工智能如何改变日常生活",帮助命令
uv run python cli.py --help。
- 语音合成:默认 Edge TTS(WebUI 显示为 Azure TTS V1),支持 Azure TTS V2、SiliconFlow TTS、Google Gemini TTS、小米 MiMo TTS、ElevenLabs TTS、自托管 Chatterbox TTS 及无配音模式,在 WebUI 中选择 Provider 和音色并填写凭据,Edge TTS 无需 API Key。
- 字幕生成:默认 edge 模式(TTS 时间戳,速度快无需 GPU);如需更准确字幕时间轴,可在 config.toml 中设置 subtitle_provider = "whisper",指定模型如 [whisper] model_size = "large-v3-turbo",Whisper 首次使用自动从 Hugging Face 下载模型,若失败需手动下载 whisper-large-v3 放入 .\MoneyPrinterTurbo\models\whisper-large-v3 目录。
- 背景音乐放在 resource/songs,字幕字体放在 resource/fonts。
步骤 10 · 常见问题:发布到 TikTok/Instagram/YouTube Shorts 需注册 Upload-Post 账号并获取 API Key,在 config.toml [app] 下配置 upload_post_enabled、upload_post_api_key、upload_post_username、upload_post_platforms、upload_post_auto_upload、upload_post_youtube_privacy_status。ffmpeg 报错可到 https://www.gyan.dev/ffmpeg/builds/ 下载并设置 ffmpeg_path。OSError: Too many open files 可通过
ulimit -n 10240 调高限制。Whisper 模型下载失败需手动下载。相关界面见配图 1、配图 2。
