GitHub 趋势 · 第 65 期
5000 星的数学建模 Agent:一边写「可以直接提交」,一边写「获奖是不可能的」
#GitHub趋势#AI Agent#数学建模
MathModelAgent 是这轮趋势榜上少见的中文原生项目:README 全中文,17 套赛事模板、9 步自动验收、模型选择决策树,用的都是国内竞赛圈熟悉的词。它能拿到近 5,000 star 靠的是一个真痛点——三天赛制里最耗时的从来不是建模本身。但这份 README 里有两处它自己披露的矛盾:愿景写的是「自动完整一份可以获奖级别的建模论文」,免责声明写的是「目前水平直接参加国赛获奖是不可能的」;功能特性里列着 Tavily 联网搜索、RAG 知识库、HIL 人机协作,路线图里这几项全部未勾选,后面还跟着 HTML 注释,写着核心逻辑未实现。
数学建模竞赛的规则是三天之内交一份论文。选题、建模、写代码、调参、画图,最后还要按赛事模板排成一份合格的 PDF——任何一个环节卡住,三天都不够用。于是能不能让 Agent 把这条流水线一次跑完,就成了一个真需求,也解释了这类项目为什么能反复上趋势榜。
一、它已经换过一次骨架
README 的自我描述是一句话:专为数学建模设计,自动完成数学建模,生成一份完整的可以直接提交的论文。仓库 2025 年 1 月创建,主语言 Python,topic 只有四个:agent、llm、mathmodel、skills。
更值得看的是它现在的结构。README 里有一段写得很直接:「项目蒸馏成完全由 SKILLS 驱动 不再做 Harness 层」。作者在 Thinking 一节解释了原因:「两年前,我都是自己实现一套 Agent 框架,现在和以后更多的 Agent 产品直接基于 Harness 如 Codex / Claude Code / Pi + SKILLS 来构建」。边界也写明了:「项目以后只会做 SKILLS 层的迭代和优化,不会再做其他部分」。
但同一份 README 的使用教程整段保留着旧骨架:docker-compose、Redis、uvicorn、pnpm,以及命令行版本——它被挪到 master 分支,注释是「部署更简单,但未来不会更新」。换句话说,作者推荐的路径和文档里篇幅最大的那条路,已经不是同一条路了。
这不是文档没跟上而已。它说明项目的重心已经从自己实现一套 Agent 框架,搬到了在别人的 Harness 里塞 SKILLS,而这个迁移只做了一半:新的 SKILLS 段落写完了,旧的部署教程没删。
二、README 自己列出的能力
| 能力 | README 原文表述 |
|---|---|
| 端到端自动化 | 从问题分析、建模、编码、绘图到论文排版和验收,一条 /1start-mathmodel 命令全自动完成 |
| 论文模板 | 17 套 Typst 论文模板(国赛、华数杯、华为杯、MCM/ICM 等),自动匹配赛事类型 |
| 自动验收 | 9 步:文本泄漏检测 → 数值一致性校验 → Typst 编译 → PDF 可视化检查 |
| 建模知识库 | 模型选择决策树(AHP、TOPSIS、ARIMA、GA 等)+ MCM/ICM 评分标准 |
| 多 Agent | 建模手、代码手、论文手,每个 agent 可设置不同的模型 |
| 代码执行 | local Interpreter 基于 jupyter,代码保存为 notebook;云端支持 E2B 和 daytona |
| 模型接入 | 支持所有模型,走 litellm |
| 人机协作 | HIL:关键节点暂停等待审批,6 种决策动作 confirm / edit / regenerate / ask / skip / abort |
这份清单里最容易被忽略的一项是最后那个「文本泄漏检测」——它排在 9 步验收的第一位。一个面向竞赛的论文生成器,把查文本泄漏写进验收流程,本身就说明了使用者真正担心的是什么。
三、同一份 README 里的未勾选项
上面那张表来自功能特性一节。而同一份 README 的后期计划一节,把这些能力逐条列成了待办,并且每一条后面都跟着一句 HTML 注释:
| 路线图条目 | 紧随其后的注释(README 原文) |
|---|---|
| human in loop (HIL) | 数据模型已实现,但工作流集成不完整 |
| feedback:评估器评分 + 反馈注入重跑 | 核心逻辑未实现,仅有 Agent 基类中的 TODO 注释 |
| web search tool: Tavily API | 原计划 Tavily API 未实现,当前使用 OpenAlex 替代 |
| RAG 知识库: ChromaDB + Rerank | 仅配置项存在,核心检索逻辑未实现 |
| A2A hand off: Fallback + Evaluator Shadow Mode | 配置项和核心逻辑均未实现,仅有基础重试机制 |
这些注释藏在 HTML 注释语法里,页面渲染时看不见,但在源码里。同时,「新功能配置」一节把这五项做成了开关:SEARCH_ENABLED 与 TAVILY_API_KEY、RAG_ENABLED、HIL_ENABLED、FALLBACK_* 系列、EVALUATOR_* 系列,并注明「默认已关闭,开启后未配置外部依赖时自动降级跳过」。
于是同一项能力在三处有三种状态:功能特性里是已有能力,配置表里是可打开的开关,路线图里是没打勾的待办。要把这个项目用起来,得三处一起读。
四、上手:最短路径是桌面版,其次是 skills
作者在 README 里把桌面版标成推荐方式,理由写得明白:「桌面版已内置 Claude Code 与全套 MathModelAgent SKILLS,无需安装 Python / Node.js / Redis,也无需手动配置 SKILL,装好填一个模型 API Key 即可开始建模」。安装包按芯片分三种,macOS 已做 Developer ID 签名并通过 Apple 公证,Windows 安装包未签名。
# 桌面版(README 标注为「推荐使用方式」,前往 Releases 下载最新版本) macOS(Apple 芯片 M 系列) mathmodel-<version>-arm64.dmg macOS(Intel 芯片) mathmodel-<version>-x64.dmg Windows 64 位 mathmodel-<version>-x64.exe
如果你手上已经有 Harness,SKILLS 路径更短——下面三条命令都摘自 README 原文:
# 安装 SKILL npx skills add jihe520/MathModelAgent --all # 运行 // claude claude --dangerously-skip-permissions claude: /1start-mathmodel 完成这个数学建模任务 // codex codex --yolo codex: $start-mathmodel 完成这个数学建模任务 # 其他命令 /doctor: 检查环境配置 /typst-author: typst 知识
剩下的 docker 那条路仍然可用,只是属于作者不再迭代的 Harness 时代:
git clone https://github.com/jihe520/MathModelAgent.git # 克隆项目 # 在项目文件夹下运行: docker-compose up # 前端界面:http://localhost:5173 # 后端API:http://localhost:8000 # 配置:侧边栏 -> 头像 -> API Key
运行结果落在 backend/project/work_dir/xxx/ 目录下:notebook.ipynb 保存过程中产生的代码,res.md 保存最后的结果。姊妹项目 sci-box 单独提供科研图表与流程图模板,安装命令是 npx skills add jihe520/sci-box。
五、我的判断
| 说明 | |
|---|---|
| 适合 | 正在准备国赛、美赛一类赛事的队伍,把 Agent 当第一版草稿生成器和排版器:能省掉的是排版、代码脚手架、图表复现这些机械活;以及想看 SKILLS 怎么组织一条长流程 Agent 的开发者,17 套模板加 9 步验收是拆开就能抄的结构 |
| 不适合 | 想直接交稿的人——作者自己的免责声明写着「目前水平直接参加国赛获奖是不可能的」;以及需要二次分发或商用的团队,原因见下 |
先说许可。GitHub API 的 license 字段返回 null,仓库里没有标准开源许可,真正生效的是 docs/md/License.md 里的三行:个人免费使用,请勿商业用途,商业用途联系我(作者);禁止闭源分发;不可在其基础上提供商业服务。它不是可以自由二次分发的开源项目,商用或转分发之前必须先看这份文件。
再看文档落差。想用联网搜索、RAG 知识库、人机协作这三项,先读路线图里的注释,别只看功能特性那一节——联网搜索这一项,README 已经注明当前用的是 OpenAlex 而不是原计划的 Tavily。
最后看维护强度。4,984 star 对应的 watcher 是 25 个,不到 star 数的 1%;open issue 42 个。README 自己也写着「项目处于实验探索迭代demo阶段」,作者的原话是「我(项目作者)很忙,有时间会优化更新」。
仓库:jihe520/MathModelAgent(https://github.com/jihe520/MathModelAgent)
star:Trending 日榜快照 5,057(+264 今日);GitHub API 快照 4,984;fork 396;open issue 42;watcher 25
语言 Python · 创建 2025-01-30 · 最近推送 2026-09-10 · 默认分支 main · 仓库体积 99,677 KB · topic:agent / llm / mathmodel / skills
许可:GitHub API license 字段为 null;作者在 docs/md/License.md 声明「个人免费使用,请勿商业用途」「禁止闭源分发」「不可在其基础上提供商业服务」
最新发布:mathmodel v0.0.19(2026-09-10,17 个附件,arm64 dmg 361 MB / x64 dmg 373 MB / Windows exe 314 MB),发布说明只有两条:添加更多绘图模板、修复bug
在线托管版:https://mathmodel.top/home
数据来源:GitHub Trending 官方页面与 GitHub API · 抓取时间:2026-09-12 23:19
这期值得存的不是自动写论文这件事,而是它把一整条竞赛流水线拆成了可复用的 SKILLS 结构:17 套模板、决策树知识库、9 步验收,每一块都能单独拿出来用。至于那些还没做的部分,作者选择写在路线图的注释里而不是删掉功能清单——这一点比 star 数更值得记账。
下期如果趋势榜继续零新面孔,就按之前说的做主题族横向合集;出现高动量新面孔,就回单项目精读。想看哪个方向,评论区说一声。
#GitHub趋势#开源观察#数学建模