GitHub 趋势 · 第 34 期

12 万星的短视频生成器,多了一条用 Claude 订阅额度当 API 的路

#AI视频#AgentSkill#开源工具

先把判断放在前面:MoneyPrinterTurbo 不是新项目,2024 年就开源了,现在 122,222 star。但它这个月在月榜上又涨了 20,372 星 —— 涨的原因跟「短视频」本身关系不大,而是它把自己拆成了四种入口,其中一种是给 AI Agent 直接调用的 Skill;最近一次提交里还加了个新 provider,把本机已登录的 Claude CLI 拿无头模式跑,消耗的是 Claude 订阅额度,不是 API 余额。本期所有能力和命令都取自 README 与仓库内 Skill 文档原文,未做推测。

先说你已经在踩的坑

做一条短视频,实际上要串六个环节:写脚本、配音、找素材、打字幕、配乐、剪辑。每个环节都有一堆工具,但串起来的过程是纯手工的 —— 脚本在一个窗口,TTS 在另一个网站,素材去库存站下,字幕再跑一次语音识别,配乐自己翻歌单,最后拖进剪辑软件拼一遍。批量做十条,就是把这套重复十遍。

所以这类项目真正要解决的不是「能不能生成画面」,而是六个环节能不能被一条流水线串起来,而且每个环节都能换供应商。这也是这一期挑它的原因:它不是又一个 AI 视频模型,而是一条能换零件、还能被 agent 调用的流水线。

项目是什么

仓库名 harry0703/MoneyPrinterTurbo(https://github.com/harry0703/MoneyPrinterTurbo),自述是「利用 AI 大模型和自动化工作流,根据主题或关键词一键生成高清短视频」。122,222 star、18,877 fork,GitHub 月度趋势新增 20,372(本期月榜里涨幅最高、且还没写过的项目)。许可为 MIT(Copyright (c) 2024 Harry,实测自仓库根目录 LICENSE 文件),不是非商用许可,可商用。

项目活跃度可以放心:855 次提交,最近一次提交在 2026-09-10;仓库里 uv.lock 的提交信息写着正在准备 1.3.6 版本。功能定位一句话 —— 你给一个主题,它自动跑完脚本、配音、素材、字幕、配乐和剪辑,但你也可以在每个环节塞自己的东西。

六个环节,每一环都能换供应商

下面这张表是 README「功能特性」章节的完整清单,没有删减。它的设计思路很清楚:不绑定任何一家云服务,每一环都留了替换口。

环节可选供应商 / 能力
使用方式AI Agent / WebUI / API / CLI 四种
脚本模型Kimi、OpenAI、Anthropic Claude、Gemini、DeepSeek、通义千问、Azure OpenAI、火山引擎方舟、xAI Grok、MiniMax、小米 MiMo
聚合网关 / 本地胜算云、APIMart、Cloudflare AI Gateway、ModelScope、AIHubMix、AIML API、EvoLink、OpenRouter、Ollama、Claude Code 订阅、OneAPI、LiteLLM、Groq、Pollinations AI
视频素材本地上传;Pexels / Pixabay / Coverr 免费库存;秘塔 MiniMax H3、胜算云 AI 视频、火山方舟 Seedance、WaveSpeed、OFox、OpenAI 兼容文生图
配音Edge TTS(免费、无需 API Key)、Azure Speech、SiliconFlow、Google Gemini、小米 MiMo、MiniMax、ElevenLabs、Chatterbox、Kokoro、Fish Audio
字幕自动生成,字体 / 位置 / 颜色 / 大小 / 描边 / 背景样式可调
配乐随机 / 本地 / AI 生成,音量独立控制
画幅与成片9:16(1080×1920)、16:9(1920×1080)、1:1(1080×1080)
发布与批量一键上传 TikTok / Instagram / YouTube Shorts;批量生成多条、任务历史、配置与 API Key 导入导出

值得单独说一句的是配音这一行:Edge TTS 免费且不用申请 key,所以你可以先把整条流水线跑通、确认成片形态没问题,再去决定要不要给 ElevenLabs 花钱。先用免费件把链路验证完,这是这个项目对新手最友好的设计

上手:三条路,按你的角色选

环境要求(README 原文):建议 Windows 10、macOS 11.0 或更高版本,以及主流 Linux 发行版;本地部署需要 Python 3.11 或更高版本。GPU 不是必需项 —— 如果你主要用云端 LLM、云端 TTS 和在线素材源,CPU 和内存比 GPU 更重要。

最省事的是 Docker(README 原命令):

git clone https://github.com/harry0703/MoneyPrinterTurbo.git
cd MoneyPrinterTurbo
docker compose -f docker-compose.release.yml up

手动部署推荐 uv(README 原命令):

uv python install 3.11
uv sync --frozen

习惯 venv + pip 的话(README 原命令):

python3.11 -m venv .venv
source .venv/bin/activate
pip install -r requirements.txt

启动有图形界面就开 WebUI,要接自动化就开 API 或直接走 CLI(README 原命令):

sh webui.sh
uv run python main.py
uv run python cli.py --video-subject "AI 如何改变日常生活"
uv run python cli.py --batch-file ./tasks.json --stop-at video

第四条路是这轮新增的重点 —— 直接把 Skill 文档的地址丢给你的 Agent,剩下交给它。README 里给的原话就是下面这两行:

使用这个 Skill:https://raw.githubusercontent.com/harry0703/MoneyPrinterTurbo/main/docs/skill/SKILL.md
帮我生成一个主题为"AI 如何改变普通人的日常生活"的视频。

这条路的门槛藏在 Skill 文档里,值得提前知道:它只支持 macOS 和 Windows(Linux 用户走 WebUI / CLI,别走 Skill),全程只用 uv,并且明确要求不要启动 Docker、WebUI 或 API 服务。Agent 实际执行的是这一条命令(SKILL.md 原文):

uv run --no-project --python 3.11 python mpt_agent.py --subject "<video topic>"

它的退出码设计得挺干净,值得抄一下:成功返回 0,并把成片绝对路径按 VIDEO_FILE= 的格式打出来;缺凭据返回 10,一次性列出你还需要填哪些字段,而不是让你一条条试错;出错返回 1,同时给出日志文件路径。文档里还专门写了一条规定 —— 不许用轮询等待生成完成,任务就用一条前台命令挂着,超时设 20 分钟以上。

那条用订阅额度当 API 的路

仓库根目录多出来的 Dockerfile.claude 和 docker-compose.claude.yml 指向同一个新东西:一个名为 claude_code 的 provider。它的提交说明写得非常坦率,原文大意是 —— Claude Pro / Max / Team 订阅不发 API key,凭据只有 Anthropic 自家客户端能用,所以原有的 anthropic provider 对纯订阅用户根本不可用;新增的 claude_code provider 改为调用本机已登录的 claude CLI 的无头模式(claude -p --output-format json),鉴权交给 CLI 完成,消耗的是订阅额度而不是 API 余额

几个实现细节挺有意思:这个 provider 在注册表里不需要 API Key、不需要 base URL、也不需要模型名(留空即跟随 CLI 当前默认);它会替换掉 Claude Code 自带的编程 system prompt,换成一份文案 prompt;工具和外部 MCP 配置全部关闭;并在临时工作目录里运行,避免仓库里的 CLAUDE.md 污染脚本输出。容器化部署时靠 CLAUDE_CODE_OAUTH_TOKEN 注入凭据。一句话总结这条路的价值:如果你已经有 Claude 订阅、但不想为写脚本再单独开一份 API 账单,这个 provider 就是给你准备的。当然,前提是你自己判断这样做符合服务条款与额度预期。

我的判断

适合谁:做批量口播 / 科普 / 带货短视频,且希望把生产环节全部放在自己机器上的人 —— MIT 许可、可商用、六个环节全可替换,Edge TTS + Pexels 能让你零成本先跑通;以及已经装了 Claude Code、想把短视频生产挂进 agent 工作流的开发者。
不适合谁:期待「输入主题就出爆款」的人。它解决的是流水线效率,不解决选题和内容质量;同质化素材拼出来的成片,平台侧照样会限流。

数据与核实:harry0703/MoneyPrinterTurbo(https://github.com/harry0703/MoneyPrinterTurbo)· 122,222 star / 18,877 fork,GitHub 月度趋势新增 20,372 · 最近提交 2026-09-10 · 855 次提交 · 许可 MIT(Copyright (c) 2024 Harry,实测自仓库根目录 LICENSE 文件,非非商用许可,可商用)· 环境要求、安装与启动命令均取自 README.md 原文 · Agent Skill 的作用域、退出码与命令取自仓库内 docs/skill/SKILL.md 原文 · claude_code provider 的实现细节取自该次提交的说明文本 · 数据来源:GitHub Trending 官方页面 · 抓取时间:2026-09-11 07:46

如果你也在批量做短视频,欢迎说说你的流水线是怎么拼的 —— 尤其是素材和配乐这两环,你用什么替掉了默认件?评论区聊聊,我按你们点的来。

下期预告:这期看了内容生产端,下期回到基础设施 —— volcengine/OpenViking(36,497 star,本月 +8,284),火山引擎开源的「自演化 Context 数据库」,把 agent 记忆、知识检索和 skills 放进同一套存储。若核实后撑不起一期,就换 debpalash/VoiceStudio(22,204 star,本月 +12,027,全本地部署的语音克隆与配音工作台)。

#AI视频#AgentSkill#开源工具