GitHub 趋势 · 第 77 期
它不是 harness、不是 skill,只是一目录:firstmate 让一个「大副」替你管一队 Agent
#多智能体#Agent基础设施#开源
本周全语言周榜里,整页几乎都是 agent / skills 类项目,真正没写过的干净候选只剩一个:kunchenguid/firstmate(Shell,5,615★,本周 +1,760)。它的卖点很反直觉——作者明确说它不是模型、不是 harness、不是 skill、不是 MCP、也不是 CLI,而是一个「agent distro(智能体发行版)」:你 clone 下来的仓库目录本身,就是产品。
你一个人能轻松跑一个 coding agent。但一旦想并行做三件事——修 bug、做调研、写方案、跑审计——你就会变成「标签页杂耍演员」:盯着一堆会话、在仓库间复制粘贴上下文、忘记哪个终端里跑着那个挂掉的测试。firstmate 把这个模式反过来:你只跟一个 agent(the first mate / 大副)对话,它替你跑完整支 crew。
项目是什么
firstmate 是一套「运行一队 agent 的发行版」。按 README 的原话,agent distro 是一个可移植的目录,里面装着指令、skills、工具、策略与状态约定,把一个通用 agent 变成专用 agent。没有要安装的应用:clone 下来的仓库就是 distro——AGENTS.md、打包好的 firstmate skills,以及任何终端 coding agent 都能遵循的辅助脚本。在你主会话里启动一个受支持的 harness,就实例化了你的大副,而你成了船长(captain)。
核心能力
- ▪单一联络人(One liaison):你只跟大副说话,由它派活、监督、只在真正需要决策时上升,并汇报平实的结果。
- ▪可见的 crew:每个 crewmate 跑在自己的 tmux 窗口 / Herdr 标签页 / zellij / cmux / Orca 终端里,你能看能敲;大副负责协调。
- ▪一次性 worktree:每个任务跑在干净的 treehouse git worktree(或 Orca 托管的 worktree)里,同一仓库的并行工作不会冲突。
- ▪两种任务形态:ship 任务交付被授权的改动;scout 任务在契约允许时留下独立调研报告。
- ▪显式项目模式:每个项目以 no-mistakes / direct-PR / local-only 之一交付,可加 +yolo 合并自主标志。
- ▪可选 secondmates:持久化的「二副」,在隔离的 firstmate home(自有 FM_HOME、状态、项目、会话锁)里运行,可本机也可整 home 跑在 SSH 可达的主机上。
- ▪事件驱动、零 token 监督:一个 bash watcher 睡眠等待 fleet,仅在有事需要你时才唤醒大副。
- ▪可选 Relay:用一个本地 .env 配对 token,让 firstmate 代答你在 X 和 Discord 上的公开提及。
- ▪严格项目边界:大副对你的项目只读,除非是 hard rule 1 授权的少数受保护且船长批准的操作。
- ▪重启可恢复:所有状态落在磁盘加活跃会话后端(tmux 为硬默认),随时杀掉会话,下一个会协调并继续。
内建技能与两层 skill 布局
README 列出可直接调用的内建技能:/afk(离桌监督)、/quiet(安静监督)、/ahoy(复述可见事件并逐个引导决策)、/bearings(生成四段式会话摘要)、/updatefirstmate(快进并重启所有 mate)、/stow(把未归档的 durable 知识刷进分层启动记忆)。
skill 分两层:.agents/skills/ 是 agent 加载的内部 skill,每个都带 metadata.internal:true,会被 npx skills add 这类安装器隐藏;skills/ 是公开、可独立安装到任意项目的 skill(目前是通用的 skills/stow),刻意不与内部版共享代码,两者可独立演进。
上手(命令均取自 README 原文)
Requirements(原文要点):一个受验证的主 harness——Claude Code / Grok / Pi / pi-signed / omp / Codex / OpenCode / Cursor Agent CLI;Git 与 GitHub CLI(gh auth login);所选后端的 CLI 与依赖(tmux 为参考默认)。
gh auth login git clone https://github.com/kunchenguid/firstmate cd firstmate
然后启动某个主 harness,AGENTS.md 接管:
claude # 或 grok --trust # 或 pi
对话示例(README 原文逐字):
> ahoy! look at my github project xyz, then fix the flaky login test and add dark mode # firstmate checks its toolchain (asking your consent before installing anything), # clones the project under projects/ and spawns two isolated workers in the active backend. # Minutes later: PR ready for review, captain: https://github.com/you/xyz/pull/42 (fix flaky login test - risk: low - CI green) > alright merge it
适合谁:已经被「多 agent 并行」逼成标签页杂耍演员、且主力用 Claude Code / Grok / Pi / Codex / OpenCode / Cursor 的人;想要一个「单一对话入口 + 可见 crew + 干净 worktree」的工作流。不适合谁 / 坑:① 成熟度要看清——API 显示 1,315 个未关 issue 对 5,615 星,比例偏高,很多能力依赖 harness 的 hook 与信任开关(--trust、/hooks-trust、项目信任弹窗),首次 clone 后需逐个批准;② 「没有要装的应用」的另一面是:你跑的是 main 分支上可变的指令目录,没有版本化发布包,可复现性靠你自己钉 commit;③ 可选的 Relay 会代你在 X / Discord 公开回复,范围要自己把关;④ Pi 的 /calm 会把运营输入从渲染里隐藏(模型上下文不变),对透明度敏感的人要留意。
仓库:github.com/kunchenguid/firstmate
星标:5,615(GitHub API 与周榜一致);本周 +1,760;fork 1,761;未关 issue 1,315;subscribers 26
主语言:Shell;许可证:MIT;建仓 2026-06-12,最近 push 2026-09-13,默认分支 main,未归档
抓取时间:2026-09-13(北京时间)
你在用哪一款「多 agent 协作」方案?是 harness 原生并发、还是另起一层编排?欢迎在评论区说说你的踩坑。
下期预告:若三榜继续被写过 / 合规排除占满,兑现欠了多期的「把模型塞进小设备与边缘」主题族横向合集(jundot/omlx、NVlabs/cuda-oxide 等);若出现更高动量干净新面孔,继续单项目精读。
#多智能体#Agent基础设施#开源
