TechMoon 科技月球
WordPress、SEO 與 AI 工具實測指南
TechMoon 科技月球
WordPress、SEO 與 AI 工具實測指南

MathModelAgent 是掛在 Claude Code 與 Codex 上的數學建模技能集,輸入賽題後從分析、建模、寫程式到 Typst 論文排版與驗收一條指令接力完成,內建 17 套競賽模板。本文整理三種用法的費用(自架 0 元、桌面版 99 元人民幣買斷、線上積分制)、個人免費商業禁用的授權條款,以及功能列表與程式碼現況的落差。
用 AI 摘要這篇文章:
數學建模比賽的現場大致長這樣:三天兩夜、一道賽題、三個人,最後交出一份二三十頁的論文。模型可以拼,程式可以熬夜,最磨人的往往是把假設、求解過程、圖表和參考文獻組裝成一篇格式合規的論文。中國開發者 jihe520 的 MathModelAgent 就是衝著這段流程來的:輸入賽題,讓 AI 把分析、建模、寫程式、畫圖、排版、檢查一路做到產出可直接提交的 PDF,願景是把三天的比賽壓進一小時。

先回答三個最常見的問題。它真的能跑完整條流程嗎?官方文件裡流程與產物都齊備,生成品質和速度則取決於你接的模型與題目,這裡不替它打包票。要花多少錢?自架一毛不花但吃自己的模型額度,桌面版人民幣 99 元買斷,線上版人民幣 30 元起跳。真的開源嗎?原始碼全公開,但授權條款寫明個人免費、商業用途要另行授權,嚴格來說是開放原始碼(source-available),與一般認知掛 OSI 授權的開源有段距離。
MathModelAgent 最近做了一個大轉向:它把主力從自己包辦前後端的網站服務,移到一套可以直接裝進 Claude Code 或 Codex 的技能(skills)。作者在文件裡寫得很直白:兩年前自己做一整套 Agent 框架,現在和以後直接基於現成的 Harness 加 SKILLS 構建,專案今後只迭代技能層。翻開 repo 的 skills 目錄,這條生產線分成六站:1start-mathmodel 啟動並生成計畫,2analysis-modeling 拆題與建模,3coding-visual 寫程式與產出圖表,4drawio 畫流程圖,5writing 套模板寫論文,6verity 做最終驗收。在 Claude Code 裡輸入一條 /1start-mathmodel,六站自動接力。
模板是這套工具最實的資產。5writing 技能內建 17 套競賽論文模板,14 套中文加 3 套英文,從國賽 CUMCM、華數杯、華為盃、MathorCup、數維盃,到美賽 MCM 與亞太賽 APMCM 都有,每套同時提供 Typst 與 LaTeX 兩種引擎版本。對台灣隊伍來說,對口的自然是 MCM/ICM 和 APMCM。繪圖另有姊妹專案 sci-box,把 SHAP、ROC、泰勒圖這類科研圖表與可編輯的 draw.io 流程圖模板獨立成套件,能單獨安裝使用,競賽論文常見的技術路線圖與研究框架圖都包在裡面。另外還有一份 456 行的建模知識庫放在 _references 目錄,內容從評價、預測、優化、圖論各類模型的選型決策樹,到 MCM/ICM 的專項寫作規範都有,每個階段的技能都會回頭查它,用意是降低模型自由發揮的空間。
驗收這一站值得單獨講。6verity 會檢查章節數量、標題順序、圖表引用、數值一致性、占位符殘留、內部文件外洩、參考文獻,以及程式可否重現,最後實際編譯一次 PDF 做視覺檢查。AI 生成論文最常見的翻車點,像是憑空捏造數字、引用對不上、排版爆版,這裡都設了專門的關卡,交卷前先替你擋一道。
流程跑起來之後,工作目錄會留下一整套看得見的產物:plan.md 記錄流程方案與排版引擎、競賽類型這些關鍵決定,todo.md 追蹤各階段待辦,reports/ 收進各站的分析、結果與驗收報告,code/ 放每個子問題對應的 Python 檔。對參賽者來說這點很重要:整條生產線不是黑盒子,哪個環節出問題,回頭翻對應的報告就能定位,程式碼落在自己機器上,賽後重跑驗證也沒有障礙。隨附還有兩個工具技能,/doctor 做環境健檢,typst-author 負責排版疑難的知識查詢。
想裝進自己的環境,一行 npx skills add jihe520/MathModelAgent --all 就把技能抓下來。掛在 Claude Code 上的技能這一年越來越熱鬧,我們先前整理過的Claude 技能精選清單是總覽入口;想把長文件整理成可調用技能的玩法,可以參考倉頡 Skill 的做法;想自己拖曳搭建再匯出的,還有Agent Skills 構建器 Refly 這條路。模型這層 MathModelAgent 走 litellm,等於市面上叫得出名字的模型都能接,每個環節還能指定不同模型。
價格頁把錢的邊界寫得比多數同類產品清楚,三種用法對應三種帳單。自架技能的人付 0 元,成本全部在自己的模型 key 或訂閱額度上,實際花多少取決於題目與模型,可以對照我們先前的AI 方案額度與 token 成本比較抓個概念。桌面版安裝檔從 GitHub Releases 免費下載(v0.0.9,2026 年 8 月 21 日發布),但平台服務按模式扣積分:Chat 模式每次 1,000、Agent 模式 2,000、Harness 模式 5,000;人民幣 99 元的終生版,買的是桌面端新對話終生免除這筆平台積分,模型費照樣自己出,支援自帶 key,雲端沙箱 E2B 也可以用自己的。線上版走積分充值,人民幣 30 元換 30,000 積分,按 Harness 模式每次 5,000 積分算,一個入門包大約夠跑 6 輪完整流程;同一對話的首次請求會先收一筆伺服器固定成本,之後按 token 計。換算一下就知道模式選擇直接決定錢燒多快:同樣 30,000 積分,開 Chat 對話可以發起約 30 次,走 Harness 全流程只剩 6 輪。

換句話說,真要用得久,99 元買斷加自己的 key 是主力路線,30 元積分包比較像試用票。兩件事先想清楚再掏錢:充值走支付寶,人民幣計價,價格頁沒有提其他付款方式,台灣用戶的付款摩擦要先自己確認能不能過;另一個是隱性成本,跑整條論文生產線的 token 消耗不便宜,模型等級選得越高,帳單越可觀。
MathModelAgent 官網每個頁面的表頭都掛著 20k+ Stars 的徽章。實際查 GitHub,主倉庫 3,695 顆星,官網的數字膨脹了五倍有餘;就算把作者名下 22 個倉庫全加起來也只有 4,967 顆,離 20k+ 仍有一大截。星數本來就該打折看,但拿膨脹的星數當信任狀,行銷成分高於實情,心裡先打個折沒有壞處。
打折不等於否定,這個 repo 是真的活躍。最後一次推送在 2026 年 8 月 21 日,桌面版從 8 月 8 日起 13 天內連發 8 個版本,範例倉庫放著 2023 華數杯、2024 與 2025 國賽的完整成品,作者也在 README 裡聲明專案還在實驗迭代階段。把它理解成一個快速演進中的賽季工具,比理解成成熟商業軟體準確得多。

README 與價格頁都寫著完全開源免費。但整個倉庫找不到任何一份正規授權檔:根目錄沒有 LICENSE,GitHub 的授權偵測結果是空的。唯一的條款藏在 docs/md/License.md,全文三行:個人免費使用,請勿商業用途,商業用途聯繫作者;禁止閉源分發;不可在其基礎上提供商業服務。
這三行讓 MathModelAgent 落在開放原始碼而非開源授權的位置,差別很實際。學生拿來寫作業、打比賽、做研究,免費且安心;公司想把它包進自家產品,或補習班想用它開收費服務,就踩到條款紅線,得先找作者談授權。只看完全開源四個字就搬進商業用途,風險是自行承擔的。這種自訂條款在獨立開發者專案裡並不罕見,作者靠 99 元桌面版與積分充值支撐開發,限制商業轉賣也算自保,只是行銷文案與授權現實之間的落差,讀者有權知道。
README 上半部的功能列表很精彩:Tavily 網路搜尋、ChromaDB 知識庫、HIL 人機協作的六種決策動作、四層容錯機制。翻到同一份 README 的後期計畫區,勾選狀態與註解卻是另一個故事:網路搜尋原計畫接 Tavily API,註解自承未實現,目前用學術文獻 API OpenAlex 替代;知識庫檢索(RAG)僅配置項存在,核心邏輯未實現;HIL 的資料模型有了,工作流整合不完整;四層容錯對應的 A2A 機制只剩基礎重試。
同一份文件自相矛盾,上半部描述的是目標形態,計畫區才是現況。照功能列表做期望管理會踩空,特別是期待它會主動查網路資料的人:真正上線的是 OpenAlex 學術文獻查詢,性質與通用網路搜尋不同。還有一個時間陷阱:README 下半部留著完整的 Docker 與本地部署教學,也就是後端加前端加 Redis 那套網站版,但作者明說未來只迭代技能層,舊的 CLI 分支也標註不再更新。照著一年前的 Docker 教學自架,裝到的是維護凍結的舊架構,文件沒拆乾淨是事實,吃虧的是照著做的人。
技術上做得到,不等於比賽能直接交。以台灣隊伍最常碰到的美賽 MCM/ICM 為例,COMAP 官方規則明定:隊伍若使用 AI,必須在報告末端加上一個名為 Report on Use of AI 的章節,說明用了哪些工具、用在什麼地方,這一節不佔 25 頁篇幅上限,正文相關位置也要揭露。整篇由 AI 代工再直接署名交出,違反的是白紙黑字的比賽規則,早就超過倫理灰色地帶的層次。
比較健康的用法是把生產線當骨架。用它把模板、章節結構、圖表與文獻格式先立起來,模型推導與數字自己驗算,AI 使用情形照規則揭露,這種用法既合規也更能學到東西。官網還整理了全年賽事月曆,2 月美賽、4 月 MathorCup、9 月國賽與華為盃研究生賽、11 月大灣區盃,一年十多場比賽的時程與費用量級一覽,並註明以各賽事當年官方通知為準,排訓練時程時直接可用。競賽之外的場景壓力小得多:課堂訓練題、研究草稿、資料分析報告的排版,都是它發揮模板與驗收優勢的地方。
桌面版把 Claude Code 與全套技能一起打包,免裝 Python、Node.js 與 Redis,填一個模型 API Key 就能開工,對不想碰終端機的隊友相當友善,336MB 的體積換來的就是這份開箱即用。兩個但書要留意:Windows 安裝檔目前未簽名,首次執行會被 SmartScreen 欄下,官方提醒務必從 GitHub Releases 頁面下載,別抓來路不明的重打包;macOS 版已經過簽名與公證,這點相對穩。版本號還停在 0.0.x,13 天 8 個版本的節奏代表進化快,也代表踩坑機率高,跟最新版走、重要比賽前先鎖定一個用順的版本,是比較穩當的做法。安裝後應用程式會自動檢查更新,macOS 版支援自動更新;社群討論主要在官方 QQ 群,官網頁尾也放了 Bilibili 與小紅書的作者帳號連結,跨海參與前先有心理準備。
不用先掏錢。手上有 Claude 訂閱或任一家 API Key 的人,用 npx skills add jihe520/MathModelAgent --all 裝完,先跑 /doctor 看環境檢查,再挑一道考古題丟給 /1start-mathmodel,觀察兩件事就夠:它生成的計畫與章節,符不符合目標競賽的論文規範;6verity 的驗收報告,抓不抓得住數值與引用的錯誤。兩關都過,99 元買斷或長期自架才值得考慮;計畫就亂編文獻,後面的模板再多也救不回來,額度留著直接對話模型反而實在。還沒用過 Claude Code 的人,可以先從Claude Code 教學把環境裝穩,再回來接這條論文生產線。