金钱打印机Turbo
一句话简介
一款基于Python的AI短视频自动生成工具,可一键从主题文案生成短视频,并自动合成视频、字幕与背景音乐。
标签
适用应用场景
- 自媒体批量生成短视频
- 营销文案转视频广告
- 知识科普短视频制作
- 社交媒体内容自动生产
README 中文摘要
MoneyPrinterTurbo:AI 一站式短视频生成工具
只需提供视频主题或关键词,MoneyPrinterTurbo 即可自动生成视频脚本、匹配素材、生成字幕与背景音乐,并最终合成高清短视频。
核心特性
- 提供 AI Agent、WebUI、API、CLI 四种使用方式,代码按控制器、服务、模型等职责分层
- 支持 AI 自动生成视频脚本,也可使用自定义脚本
- 支持竖屏 9:16(1080×1920)与横屏 16:9(1920×1080)两种高清尺寸
- 支持批量生成,一次产出多个版本以供筛选
- 支持视频片段时长设置,便于调节素材切换节奏
- 支持多语言脚本生成
- 集成 Edge TTS、Azure Speech、SiliconFlow、Google Gemini、小米 MiMo、ElevenLabs、Chatterbox、Fish Audio 等多种语音合成方案,可在界面实时试听
- 支持字幕样式调整(字体、位置、颜色、大小、描边、背景)
- 支持随机或指定的背景音乐,并可调节音量
- 素材来源:本地素材 + Pexels / Pixabay / Coverr 免费高清图库 + WaveSpeed AI 文生视频模型(默认 Seedance)
- 模型支持:Kimi / Moonshot、OpenAI、Anthropic Claude、Google Gemini、DeepSeek、阿里云通义千问、Azure OpenAI、火山引擎方舟、xAI Grok、MiniMax、小米 MiMo,并兼容 Cloudflare AI Gateway、魔搭 ModelScope、AIHubMix、AIML API、EvoLink、Ollama、OneAPI、LiteLLM、Groq、Pollinations AI 等统一网关与聚合平台
- 支持一键跨平台发布至 TikTok、Instagram、YouTube Shorts
- 支持导出/导入预设文件,在界面统一备份与恢复所有 API Key
配置要求
- 推荐系统:Windows 10、macOS 11.0 及以上、主流 Linux 发行版
- Python 3.11+,建议使用 Python 3.11
- GPU 非必需,但本地转录或批量生成时建议使用 4GB 以上显存的独立显卡
快速开始
使用 AI Agent 生成视频
如果你的 AI Agent 支持读取 Skill 文档并操作本地终端(目前支持 macOS 与 Windows),可直接发送以下指令,Agent 会自动完成安装、配置与生成流程,仅在缺少必要 API Key 时向用户询问:
使用这个 Skill:https://raw.githubusercontent.com/harry0703/MoneyPrinterTurbo/main/docs/skill/SKILL.md
帮我生成一个主题为"人工智能如何改变普通人的日常生活"的视频。
Google Colab 一键运行
通过 Colab 免去本地环境配置,直接在云端体验。
Windows 一键启动包
下载压缩包后,先双击 update.bat 更新代码,再双击 start.bat 启动。解压路径请避免中文、特殊字符与空格。默认浏览器如显示空白,建议改用 Chrome 或 Edge。
Docker 部署
cd MoneyPrinterTurbo
docker compose -f docker-compose.release.yml up
# 默认拉取 ghcr.io/harry0703/moneyprinterturbo:latest 预构建镜像
# 首次启动前将 config.example.toml 复制为 config.toml 供容器挂载
启动后访问 WebUI:http://127.0.0.1:8501,访问 API 文档:http://127.0.0.1:8080/docs 或 http://127.0.0.1:8080/redoc。
手动部署
推荐使用 uv 管理依赖:
git clone https://github.com/harry0703/MoneyPrinterTurbo.git
cd MoneyPrinterTurbo
uv python install 3.11
uv sync --frozen
也可使用 venv + pip:python3.11 -m venv .venv && source .venv/bin/activate && pip install -r requirements.txt。
启动 WebUI:
# Windows
.\webui.bat
# macOS / Linux
sh webui.sh
# 允许局域网访问
export MPT_WEBUI_HOST=0.0.0.0
启动 API 服务:
uv run python main.py
命令行方式(无浏览器):
uv run python cli.py --video-subject "人工智能如何改变日常生活"
uv run python cli.py --help # 查看全部参数
语音合成
默认使用免费 Edge TTS(界面显示为 Azure TTS V1),同时支持 Azure TTS V2、SiliconFlow、Google Gemini TTS、小米 MiMo TTS、ElevenLabs、自托管 Chatterbox、Fish Audio 以及无配音模式。可在 WebUI 直接切换 Provider 和音色,Edge TTS 无需 API Key,其余服务需填写对应凭据。
字幕生成
edge:基于 TTS 时间戳,速度快、无需 GPU(默认)whisper:使用本地faster-whisper转写音频,时间轴更精确,首次使用需下载模型
切换模式与模型:
[app]
subtitle_provider = "whisper"
[whisper]
model_size = "large-v3-turbo"
如自动下载失败,可从 Hugging Face 手动下载后放入 MoneyPrinterTurbo/models/whisper-large-v3。
背景音乐与字幕字体
背景音乐位于 resource/songs,字幕字体位于 resource/fonts,均可替换为自有素材。
跨平台发布(TikTok / Instagram / YouTube Shorts)
注册 Upload-Post 并获取 API Key,在 config.toml 中启用:
[app]
upload_post_enabled = true
upload_post_api_key = "your-api-key"
upload_post_username = "your-username"
upload_post_platforms = ["tiktok", "instagram", "youtube"]
upload_post_auto_upload = true
upload_post_youtube_privacy_status = "public"
常见问题
- ffmpeg 缺失:
RuntimeError: No ffmpeg exe could be found,从 https://www.gyan.dev/ffmpeg/builds/ 下载后,在config.toml设置ffmpeg_path即可。 - Too many open files:执行
ulimit -n 10240调高系统文件句柄上限。 - Whisper 模型下载失败:网络受限时改用 Hugging Face 手动下载方案。
摘要更新于 2026-08-23 00:32:55
· 原文 22714 字符
· md5 ce875e7f50ba…