TryAii 免費層比你想的大:592 個模型比價免登入,並排對比才要付 1.5 倍價

TryAii 不只並排對比:592 個模型的比價儀表板免登入就能查,牌價與 OpenRouter 目錄一致;真的要並排跑模型走 Google 登入與額度制,條款寫明原廠價 1.5 倍,自帶金鑰可繞過;挑模型的路由引擎以 Apache-2.0 開源,可本地跑不傳 prompt。

用 AI 摘要這篇文章:

想把同一段 prompt 同時丟給 GPT、Claude、Gemini 看誰答得好,搜尋結果裡叫 TryAii 的平台常被介紹成「AI 大模型並排對比工具」。實際打開 tryaii.com 會發現它現在的樣貌比這個說法複雜:並排對比確實存在,但在 Google 登入牆後面;真正不必登入就能用的,是一套 592 個模型的比價儀表板;而且它的「挑模型」邏輯另外做成了開源引擎,可以整組下載到本機跑。這篇把三件事講清楚:不付錢能用到什麼、真的要跑模型會花多少、以及不想把 prompt 交給第三方時有什麼替代路線。

先講結論:如果你只是要比價和看排行,TryAii 的儀表板完全免費而且不必註冊;如果你想真的並排跑模型,它的額度制帳單是原廠價的 1.5 倍,值得先算一筆帳再按下送出。

不登入能用到什麼:592 個模型的比價儀表板是公開的

導覽列上的 Benchmarks 頁面不需要任何帳號。頁面本身標示 592 個模型、51 種基準測試,廠商分布前幾名是 OpenAI 103 個、Qwen 64 個、Google 45 個、Anthropic 34 個、Mistral 33 個、DeepSeek 21 個,連 NVIDIA、Meta、智譜(z-ai)都在清單裡。主畫面是一張「品質對上成本」的散點圖,橫軸是每百萬 token 的牌價(對數刻度),縱軸是站方自己換算的 TryAii Score,還會畫出帕雷托前緣(Pareto frontier)讓你直接看「同一個分數帶裡最便宜的是誰」。

排序結果值得停下來看兩眼。2026 年 9 月的排行榜上,Claude Fable 5.1 以 94.9 分排第一,輸入輸出牌價是每百萬 token 10 與 50 美元;第二名 Gemini 3.8 Flash 拿 93.4 分,牌價只有 0.75 與 3.75 美元。1.5 分的差距,帳單差了十三倍。這種「分數很接近、價格差一個量級」的組合,正是這類儀表板最實用的地方:如果你的任務不需要頂規模型,第二名往往就是正確答案。

TryAii Benchmarks 儀表板截圖:模型排行榜列出 Claude Fable 5.1 九十四點九分、Gemini 3.8 Flash 九十三點四分等,附各模型輸入輸出牌價Pin
TryAii 的 Benchmarks 排行榜免登入可看,分數與每百萬 token 牌價並列(圖片來源:tryaii.com)

價格數字的可信度也查得到出處。站方公開的資料介面顯示,定價資料集 592 列的來源欄位全部標記 OpenRouter API,其中 439 列的抓取時間落在 2026 年 9 月,旗艦型號的牌價與 OpenRouter 官方目錄逐項一致,例如 GPT-5.6 Sol 的每百萬 token 2 與 10 美元兩邊相同。換句話說,這個儀表板顯示的是 OpenRouter 口徑的牌價,不是站方自己發明的數字。分數的來源也一樣攤開:基準資料分成靜態與動態兩組,靜態組 4,811 筆來自模型卡、論文與第三方評測彙整(Artificial Analysis、Stanford HELM、Vals AI 等),動態組 1,007 筆以 Chatbot Arena(LMSYS,現 Arena AI)的 Elo 排行資料集為最大宗,其餘來自 LiveBench 與 MT-Bench,每一筆都附原始連結可供回查。要注意的是牌價等於「原廠直付的價格」,如果你透過 TryAii 的額度跑模型,實際帳單是另一回事,下一節會算;另外散點圖的縱軸用站方換算的 TryAii Score,592 個模型裡只有 238 個有這個分數,頁面實際畫出 236 個,長尾模型的牌價多半齊全,缺的是 TryAii Score。

「這個任務該用哪個模型」,不用登入也有答案

TryAii 首頁有一個不顯眼的輸入框:打一段任務描述,它告訴你該用哪個模型。這個功能不需要登入,連中文都吃得下。實際送出「把這段中文行銷文案改寫成繁體中文的社群貼文」,服務端把任務歸類為對話類,第一名給 GPT-5.6 Sol(配對分數 0.95),後面跟著 Claude Fable 5、GPT-5.5、Claude Opus 5;換成英文的 Python 重構任務,分類換成技術類,榜首不變。回應裡連推薦理由都給了:它會註明「Chatbot Arena 表現優異、進階推理強、與任務契合度 62.7%」這類依據,讓你判斷這個排名聽不聽得下去。它的運作方式是把 prompt 分類成任務類型,再拿各模型在對應基準上的表現去加權,你自己調整品質、速度、價格三個滑桿,權重就會重排。

模型數量在站上出現好幾種口徑,使用時要知道各自講的是哪一層。首頁英雄牆列了 GPT-5.6、Claude Fable 5、Gemini 3.6、Grok 4.5、DeepSeek V4 五個旗艦,旁邊寫「再加 42 個」;常見問題頁寫「40 個以上」;開源引擎附的模型目錄是 39 個(2026 年 6 月更新);首頁另一張路由示意圖寫「30 個已映射模型」;而基準儀表板的 592 是資料宇宙,含 OpenRouter 目錄上的 batch 變體與別名。簡單講:路由推薦用的是幾十個模型的精選清單,592 是拿來查價查分的資料庫。輸入框下方也附了幾個現成範例按鈕,重構 Python、解釋物理、草擬信件、摘要筆記之類,點下去就是一輪示範,第一次用可以先拿這些感覺它的分類準不準。

有一個隱私細節要知道:這個推薦服務不是在瀏覽器裡算的。輸入任務送出時,請求會打到站方的推薦介面,分類與排序都在他們伺服器上完成,頁面同時載有 Google Analytics(編號 G-2KP3ZV4ZNW)。不必登入不代表 prompt 不出門,這點跟後面開源引擎那段對照著看會更清楚。

真的要並排跑模型:Google 帳號、免費額度,和 1.5 倍的帳單

並排對比(Compare)與聊天(Chat)是 TryAii 的核心功能,也是註冊牆所在的位置。兩個頁面在未登入狀態都只顯示「Authentication Required(需要驗證)」的提示和 Sign In with Google 按鈕,沒有電子郵件註冊的選項。登入後依官方說明會拿到一筆免費試用額度,可以立刻跑對比,但額度有多少,站方沒有在任何公開頁面寫明。牆內的對比介面依站方與開源文件的自述,會把同一段 prompt 送進你勾選的多個模型,輸出並排列版,每欄即時標註 token 用量、回應延遲與該次呼叫的成本,過程可以存成紀錄、做成分享連結給同事,常用的 prompt 也能存成範本重複使用。值得留意的是這套介面的賣點在「把結果攤開給你看」,而不是「幫你判斷誰比較好」:品質高低的結論仍然要你自己下,它負責的是把延遲與成本這兩個客觀數字算清楚。

TryAii Compare 頁面截圖:畫面中央顯示 Authentication Required 與 Sign In with Google 按鈕,並排對比功能需登入Pin
並排對比功能在 Google 登入牆後面,沒有電子郵件註冊選項(圖片來源:tryaii.com)

計價結構寫在使用條款裡,而且是現行版本:TryAii 對透過平台發出的每次 API 呼叫,收取該模型原廠價的 1.5 倍。換算成實際數字,GPT-5.6 Sol 牌價每百萬 token 輸入 2 美元、輸出 10 美元,走 TryAii 額度等效於 3 與 15 美元;Claude Fable 5 的 10 與 50 美元變成 15 與 75 美元。用前述旗艦裡牌價最便宜的 Gemini 3.6 Flash(0.75 與 3.75 美元)也一樣乘上 1.5。對照站方 2025 年 4 月的發文自述「在原廠成本上加收小幅度費用」,50% 在數學上是加收一半,算不算小,看你跑的量。附帶一提,條款同時註明頁面顯示價格未必即時、站方會盡力更新;這個免責目前看是保守寫法,資料集裡旗艦型號的牌價抓的是 2026 年 9 月的批次,但挑長尾模型時仍值得自己再確認一次原廠頁面。

不想付這個倍率有一條官方出路:設定頁可以填入自己的 OpenAI、Anthropic、Google、xAI、DeepSeek、Mistral 金鑰,站方說法是這些用量會直接走你自己的原廠帳戶計費,不消耗 TryAii 額度。這段是站方文件的陳述;金鑰實際存在哪裡、怎麼轉發,登入牆外看不到,對金鑰權限敏感的人,建議用限制額度的專用金鑰。

隱私面也要一起看。隱私政策(2025 年 4 月版)載明你送出的 prompt 內容會分享給對應的第三方模型服務,並可能暫存用於改善平台;付費透過 PayPal 等支付服務。加上前述的 GA 統計,走平台額度的路線裡,你的 prompt 至少會經過 TryAii 與模型原廠兩手。另外兩個實際面的邊界:介面只有英文,沒有中文版;站方主體只揭露到「TryAii Team」與部落格作者署名 Tamir,查不到公司法人資料,網域 2025 年 3 月經 NameCheap 註冊。個人嘗試無妨,公司採購要對接主體或開發票,這條鏈是斷的。

首頁還有幾張現成的旗艦對比表,用星號給 GPT-5.6、Claude Fable 5、Grok 4.5 這類組合評「回應品質」「速度」「成本效率」。這些星號表格讀的時候要打點折扣:它沒有附評分方法或資料來源,比較像行銷摘要;點下去的「Compare models」按鈕最終還是把你帶進需要登入的比較介面。要看有出處的比較,回 Benchmarks 儀表板查分數與牌價踏實得多。

不想把 prompt 交給第三方:路由引擎可以整組帶回家

TryAii 挑模型的邏輯,另一個身分是 Apache-2.0 授權的開源專案,pip 或 npm 裝的套件名就叫 tryaii。README 的定位寫得很直白:路由在你的機器上跑,分類用的嵌入模型(Python 版用 sentence-transformers,Node 版用 ONNX MiniLM)都在本機運算,只是要「排名」的話完全不需要任何 API 金鑰;只有要 SDK 代你「呼叫」選中的模型時,才需要填一把 OpenRouter 金鑰。也就是說,排名這段腦力可以免費留在自己機器上,而且 prompt 不出門。

套件附的模型目錄有 39 個型號,每個都帶基準分數、牌價與延遲等級,目錄版本 2026 年 6 月更新,因此比網站英雄牆舊(GPT-5.6、Gemini 3.6、Grok 4.5 還沒收錄)。命令列工具箱裡除了單次路由,還有整批資料集在預算內分配的 eval 指令,可以設總預算上限,讓它把錢花在難的題目上;另外一支 cachelint 會在送出前檢查你的 prompt 排版會不會命中各家供應商的快取條件,內建 18 種偵測器並按模型給出預期命中或落空的判斷,對靠快取省錢的應用是實用的小工具。套件裡另有設計夥伴計畫的註冊指令,會把問卷結果傳到 api.tryaii.com,分成「只留聯絡」、「加總結洞察」與「完整共享」三級授權,每一級要送出什麼都先寫清楚,屬於明確選擇加入才會觸發,預設不連線。

不過它的年紀與人氣要先講清楚:GitHub 儲存庫 2026 年 4 月才建立,到 9 月累積 3 顆星、1 個 fork,npm 套件一個月下載約 186 次。原始碼仍在更新(最後推送在 2026 年 9 月),但採用規模就是新專案的規模,遇到問題大概只能自己讀原始碼解決。如果你能接受本機跑工具,這條路可以跟其他自帶金鑰的方案串起來:瀏覽器端直接測 API 速度與模型真偽可以看 LLM API Test 的拆解;想把多家供應商整合成單一端點再自架的,new-api 是現成方案;同樣走「金鑰直連、不經中間站」邏輯的還有 prompt-optimizer

一年半換過一次樣貌的站,教學文的保存期限比你想的短

TryAii 的歷史對照著看很有意思。網頁典藏在 2025 年 5 月 9 日的快照裡,這個站的標題是「Compare GPT (o3, o4-mini, o1 pro), Gemini 2.5, Claude 3.7, DeepSeek & Mistral APIs」,那個時代它是純粹的並排對比站,主打 o3 與 Claude 3.7 這一代模型,首頁教學是「註冊拿試用額度、選模型、送 prompt」;站方變更紀錄顯示 2025 年 4 月 19 日上線 1.0 版。現在的首頁英雄牆已經是 GPT-5.6、Claude Fable 5、Gemini 3.6 這一代,站點定位也多了路由推薦與基準資料庫兩塊。換句話說,一年半內這個產品換過一次核心樣貌,網路上任何點名具體型號的舊介紹,講的都可能是一個已經不一樣的站。站方部落格倒是持續有料,團隊拿自己的平台做過「25 個模型回答上帝存在問題」「24 個模型比賽寫搭訕台詞」這類整批實驗,2026 年 6 月還發了 prompt 快取的技術文,看得出這個站對「模型行為資料」的興趣是真的。

還有一個反差值得記錄:對外溝通管道停得更早。變更紀錄頁的最後一條停在 2026 年 1 月 4 日的 2.0.8 版,之後八個月沒有更新;但資料管線是活的,定價資料集有 439 列是 2026 年 9 月抓的。產品在動、部落格在 6 月還有新文章,只是 changelog 這個欄位荒廢了。對使用者的啟示很簡單:看它的資料不用擔心時效,看它的公告要自己上手驗證。

四條路線怎麼選:免費查價、登入代跑、自帶金鑰、本地開源

你的情況建議路線要注意
只想比價、看哪個模型 CP 值高Benchmarks 儀表板,免註冊牌價是 OpenRouter 口徑,非 TryAii 額度價
想知道某類任務配哪個模型首頁路由推薦框prompt 會送到站方伺服器,且有 GA 統計
想真的並排跑模型比較輸出Google 登入,先用免費額度額度用完是原廠價 1.5 倍,常跑建議自帶金鑰
不想讓 prompt 離開自己的機器pip 裝 tryaii 本地路由+自己的金鑰專案很年輕,模型目錄比網站舊一版

TryAii 最耐用的價值,是那套不必登入、資料血緣透明的比價層,和可以帶走本地跑的開源引擎;並排對比本身反而是整個服務裡最普通的一塊,因為同樣的組合在各大平台的 playground 都找得到,差別只在誰幫你把帳單算好。先想清楚你要的是資料、推薦還是代跑,再決定要不要交出 Google 帳號。

Sliven 褚崇名
Sliven 褚崇名

每日分享科技新知、免費資源以及 WordPress、虛擬主機相關主題,任何問題歡迎在科技月球下方留言,或是發送 Email 至 [email protected] 與我聯繫。

文章: 1313

發佈留言

發佈留言必須填寫的電子郵件地址不會公開。 必填欄位標示為 *


Share to...