Summa:開源 AI 網頁摘要擴充,整頁內容送哪個模型由你決定

Summa 是開源的 Chrome 摘要擴充,點一下圖示就把整頁文章轉成 Markdown 送到你自己填的模型端點,支援 OpenAI、DeepSeek、Gemini、OpenRouter 與 Ollama 本機模型。權限只有三個、零遙測、金鑰留在本機,內容送哪個服務商由你決定;但專案 2025 年 2 月後停止維護,介面與預設輸出都是簡體中文,想看繁體中文摘要要先改提示詞。

用 AI 摘要這篇文章:

想在瀏覽器裡一鍵摘要網頁,選擇很多,但裝過幾個就會撞上同一件事:多數摘要擴充要綁帳號、綁訂閱,你讀的每一頁都得先送進對方的伺服器,摘要才生得出來。對手上已經有 OpenAI 或 DeepSeek 的 API 金鑰、甚至電腦裡就跑著本機模型的人來說,這層服務其實是多繞的:模型你自己有,缺的只是瀏覽器裡那個「按下去就摘要」的按鈕。

Summa 補的就是這個位置。它是開源的 Chrome 擴充,點一下工具列圖示,把當前網頁的文章本體抽出來、轉成 Markdown,送到你自己填的模型端點,摘要直接顯示在頁面右側的面板裡。它免費、不需要註冊,更準確地說,它沒有東西可以註冊:整個擴充不存在自家後端,模型是你選的,金鑰是你自己的,帳單也是你自己家的。

我把它在 GitHub 上的原始碼整份抓下來讀過一輪,也核對了 Chrome 商店的上架現況:資料怎麼流、錢怎麼算,以及它 2025 年 2 月之後就沒有人維護這件事,以下逐一拆開。

點一下圖示之後,頁面內容去了哪裡

先看整條摘要鏈的起點。原始碼裡,觸發摘要的方式只有一種:你點工具列圖示。背景腳本監聽的按鈕點擊事件,點了才向眼前這個分頁丟出訊號,平常瀏覽時擴充什麼都不做。這個設計看似理所當然,後面談權限時會發現它是整個隱私故事的地基。

點擊之後,頁面的 HTML 會先被送進擴充自己的一個離線解析區,用 Mozilla 的 readability 函式庫抽出文章本體。readability 這個名字或許陌生,但 Firefox 的閱讀模式用的就是同一套邏輯:導覽列、側欄、廣告、留言區都會被濾掉,只留正文。接著另一個叫 Turndown 的工具把 HTML 轉成 Markdown,因為餵給語言模型時,乾淨的 Markdown 遠比整頁雜訊有效得多。

Summa 摘要面板官方截圖:在 Medium 文章頁右側展開面板,列出 DeepSeek V3 文章的摘要與主要內容區塊,面板頂部有複製、重新整理與設定按鈕Pin
Summa 在 Medium 文章頁打開的摘要面板(官方 README 截圖)

然後是送出。擴充用 Vercel AI SDK 的介面,把你設定的模型端點直接叫起來,送出去的內容就是整篇文章的 Markdown 全文,外加一段系統提示詞。這裡沒有經過任何中繼伺服器,端點清單我在原始碼裡逐一核對過,全部是各模型服務商的官方 API 位址,或者 localhost 的本機位址,找不到任何一個屬於 Summa 自己的網域。

摘要回來之後,面板會照預設提示詞的結構呈現:一段 200 到 300 字的總摘要、按原文章節整理的主要內容,以及 3 到 5 個重要觀點或結論。這個結構寫在預設提示詞裡,但設定頁可以整段換掉:想改成純條列、想指定只摘結論、想要求以繁體中文輸出並保留英文專有名詞,都是改一段文字的事,不需要動到程式碼。對照多數同類產品把格式固定死的做法,這個自由度是它低調的優點。

面板本身的功能從原始碼看相當單純:摘要生成後有複製按鈕一次帶走全文,有重新產生的按鈕再換一次結果;面板上還能直接換模型,選了就立刻用新模型再跑一輪,而每跑一輪就是一筆新紀錄,前後切換的按鈕就在這些紀錄之間移動,同一頁就能讓不同模型各交一份摘要,來回對照挑最合用的。儲存成檔案、匯出、摘要的雲端同步一概欠奉,關掉頁面就是本次結束,想留摘要就自己複製。這種一切從簡的取向,和它把模型選擇權交給使用者的設計是同一套哲學。要注意的是輸出沒有串流:原始碼用的是一次生成完再整段回傳的呼叫方式,長文章按下之後要等一小段時間,GitHub 上唯一一則還開著的 issue 就是請求串流輸出,2025 年 4 月提出,到今天沒有人回。

Summa 摘要面板官方截圖:在 Hacker News 討論串頁面產生摘要,面板整理出討論總述、用戶使用經驗與潛在應用等條列重點Pin
Summa 摘要 Hacker News 討論串的畫面(官方 README 截圖)

三個權限、零遙測,這個擴充能碰的東西很少

Chrome 擴充安裝時跳出的權限清單,多數人看都不看就按下去,但 Summa 這份清單只有三項:activeTab、storage、offscreen,到此為止。沒有 tabs 權限,所以它列不出你開了哪些分頁、看不到瀏覽記錄;沒有 webRequest,所以它攔不到你其他的網路流量;也沒有任何 host 權限宣告。

三個權限裡最關鍵的是 activeTab。這個權限的語意是「只有在你點擊擴充的那一刻,且只對你眼前這個分頁生效」。配合前面說的觸發設計,等於讀哪一頁、什麼時候讀,主動權完全在使用者手上。它在所有網站都注入了內容腳本,但那份腳本的用途是顯示摘要面板,從程式碼看,收到點擊訊號之前它不對頁面做任何事。

遙測是另一個我特地查過的點。整份原始碼裡搜 analytics、Sentry、PostHog、Firebase 這類常見的分析工具字串,一無所獲,唯一搜到的「tracking」是 CSS 的排版樣式名稱。也就是說,使用行為統計、錯誤回報、「匿名遙測」條款這些常見配備,它一樣都不存在,因為根本沒有遙測。API 金鑰則存在瀏覽器本機的 chrome.storage.local 裡,不會跟著 Google 帳號同步,好處是金鑰不出你的電腦,代價是換一台電腦要重填一遍。

內容送哪裡,是你填金鑰那一刻決定的

這是 Summa 最核心的設計,也是它和市面上多數同類擴充的分界:它不管模型,模型清單你自己開。設定頁預設列出 14 個供應商,包括 Anthropic、OpenAI、Google(Gemini)、Groq、OpenRouter、DeepSeek、Mistral、SiliconFlow、阿里雲百鍊、Together、Hyperbolic,外加自訂的 OpenAI 相容端點、LMStudio 與 Ollama 兩個本機選項。README 上列的只是其中一半,原始碼裡的清單更長,甚至還有三個寫在程式裡但設定頁沒有出現的供應商(xAI、Cohere、HuggingFace)。

供應商的設定方式也有講究。每個供應商是一張獨立的設定卡,啟用與否由各卡上的開關控制,金鑰逐家填、逐家開,沒有「一開就全部上線」的全域開關。API 地址欄位只有三張卡有:自訂端點、LMStudio 與 Ollama,讓你把 OpenAI 相容的皮指向任何相容服務或本機位址;其餘供應商的端點是程式裡寫死的官方位址,卡片上沒得改。金鑰與設定全部存在瀏覽器本機,跟著前面提到的儲存規則走,不額外落地。

這個設計的隱私含義值得停下來想。你選雲端供應商,等於把你讀的每一頁全文送給那家服務商,你讀什麼,它就知悉什麼,邊界就是那家服務商的條款與政策。你選 Ollama 或 LMStudio,模型在自己電腦上跑,整篇文章不出本機。同一個擴充,兩種截然不同的隱私檔案,差別只在設定頁裡填了哪個位址。多數摘要擴充把這個選擇從你手上拿走,Summa 把它留給你,這是它的價值,也是使用它的責任。

模型怎麼挑,README 有作者的建議:用 Gemini 系列做摘要,理由是上下文視窗大,摘要裡能保留比較多細節。這是作者的使用心得,提供參考,你在設定頁照樣能填其他家的型號。有一點倒是實際狀況:預填的模型清單停在 2025 年初,gpt-4o、o1-mini、Claude 3.5 Sonnet 這一代,一年半以上沒有更新,不過每個供應商都開放自填型號,自訂端點的欄位也讓任何 OpenAI 相容的服務接得上,清單過時的影響比看起來小。

不花錢的用法有兩條,前提各不相同

想壓低門檻先試用,有兩條免費路線。

第一條走 OpenRouter。Summa 預設的 OpenRouter 模型清單裡,有四個帶著 free 標記的型號,包括 gemini-2.0-flash-exp 的免費版與幾個開源模型。到 OpenRouter 註冊一把金鑰填進去,不用儲值就有路線可以跑。免費額度的速率與用量上限屬於 OpenRouter 的政策,會隨時間調整,具體數字以官方說明為準。如果你手上已經有其他家的金鑰,也可以先用 LLM API Test 從瀏覽器確認端點速度與真偽,再填進擴充。

第二條走本機。電腦跑得動本機模型的話,裝好 Ollama,在 Summa 設定頁填 localhost 位址,整條鏈不需要任何帳號,也不用擔心讀的內容出門。想在瀏覽器層級用類似「自帶金鑰」思路的讀者,也可以對照 BrowserOS 這類自帶 API Key 的開源瀏覽器,那是把 AI 做進整個瀏覽器的另一條路。

對照服務制的做法會更清楚:像 Kagi News 這類新聞摘要服務,把模型、帳號、額度全部包在一起,方便,代價是內容必然經過對方伺服器,且方案怎麼改取決於對方。Summa 把這層拆開,成本與隱私自己管,但金鑰、帳單、模型挑選也就全在自己身上。

成本結構也值得算一下。雲端模型按用量計費,摘要這件事的特性是輸入遠大於輸出:整篇文章是輸入端,吐回來的摘要只是輸出端,所以讀長文時的費用主要花在把全文送進模型這一步。各家的單價不同且常調整,量級上的直覺倒是可以先建立:一般長度的網頁文章做一次摘要,通常不會是把帳單推高的那種用量,真正會讓費用有感的是拿旗艦模型反覆跑超長文件。把日常摘要交給便宜或免費的模型、疑難長文再換旗艦,是這類自帶金鑰工具的基本盤算。

裝之前要知道:2025 年 2 月之後就沒有人修它

接下來是誠實帳。這個專案在 GitHub 上 2025 年 1 月 3 日建立,2 月 13 日推完最後一筆就停,公開生命期約六週,之後一年半以上沒有動靜。Chrome 商店的最後一次更新是 2025 年 3 月 26 日,到今天仍然裝得到,累積 309 位使用者,兩則評價平均落在 3.0 分。商店那頭還活著,開發這頭是凍結的。

這對使用者的意義要說準:從商店現況與原始碼看,安裝與設定這條路沒有障礙,它用的 Manifest V3 架構也是現行標準,摘要品質本身則要裝了才知道。但沒有人維護的意思是,Chrome 哪天改了擴充的 API、模型服務商哪天改了介面,你不會等到修復的版本,唯一開著的 issue 沒有人回,就是這個狀態的縮影。把它當一個能用的小工具可以,把它當一個會持續演進的產品不行。

介面語言是安裝後第一個撞上的現實。整個設定頁是簡體中文,原始碼裡找不到任何多語系檔案,從供應商清單到系統提示的欄位名稱,全部以簡體字樣直接寫死在程式裡,沒有切換語言的選項。更關鍵的是預設提示詞也是簡體中文寫的,也就是說,不動任何設定的話,摘要會以簡體中文輸出。要讓它講繁體中文,裝好後第一件事就是到設定頁把系統提示詞改成指定繁體中文輸出,改完之後輸出就跟著正常,但這一步不會有人提醒你做。

官方說明宣稱它適用任意網站,並點名 Medium、Reddit、Hacker News、微信公眾號、知乎、CSDN 這些站。從萃取機制看,一般文章頁都在支援範圍,但各站實際效果屬於使用層的問題,付費牆或反爬蟲的頁面未必抽得出完整正文。順帶一提,readability 這類萃取器抓的是「文章本體」的語意結構,頁面內容若是靠 JavaScript 動態載入、或者根本沒有明確正文的互動式工具頁,抽出的結果就會參差,這是此類閱讀器共同的天性,並非 Summa 獨有。

誰會用得順手,誰會想刪掉它

用得順手的人有共同點:本來就在管自己的 API 金鑰。手上有 key、懂得控制預算的人,Summa 多了一個不花錢的入口,摘要的每一次呼叫都算在你自己的帳單上,花多少看得見;在意隱私且電腦跑得動 Ollama 的人,它是能把整條摘要鏈關在本機的瀏覽器方案;平常要啃長技術文件、論文或開發文件的人,固定三段式的輸出配上可自訂提示詞,比固定格式的同類產品合用。想先找免費額度來源的人,可以參考 FreeLLMAPI 這類把免費額度收進一個端點的閘道

反過來,如果你要的是「裝了就好、不想碰金鑰」,這個擴充的第一個畫面就會讓你打退堂鼓,服務制的摘要工具或 AI 瀏覽器才是對的方向;如果你期望介面有繁體中文、或者期待出問題時有人修,這兩點它現在都給不了。它是一個設計乾淨但停止呼吸的作品,適合的人會很喜歡,不適合的人五分鐘就會刪掉。

MIT 授權,和一份凍結中的體檢數字

Summa 以 MIT 授權開源,授權條款檔案就放在專案根目錄,可以自由使用、修改、再散佈。對會寫程式的讀者,這是停滯狀態下最實際的保障:供應商清單、提示詞、介面文字全在原始碼裡,想接新模型或把介面改成繁體中文,fork 過來自己改都沒有授權障礙;打包設定也一併公開,能自行打包後用 Chrome 的開發人員模式載入,不依賴商店那條線。一般使用者當然還是走商店安裝最省事,這條後路是留給願意動手的人。

專案現況的數字整理:GitHub 上 107 顆星、8 個 fork,倉庫裡的提交史有大半繼承自它使用的瀏覽器擴充樣板,開發者本人的提交落在 2024 年 11 月底到 2025 年 2 月中;沒有打包的 release 版本,官方散布管道只有 Chrome 商店;商店端 309 位使用者、2 則評價平均 3.0 分、最後更新 2025 年 3 月 26 日、安裝檔 191 KB。對應到它的設計,擴充這一端的程式碼已經凍結,不會再有誰來動它,但只要你填的金鑰端點還活著,它就會一直照現在的樣子工作下去;哪天服務商的介面真的改版把它弄壞了,MIT 授權也留了自己動手的後路。

Sliven 褚崇名
Sliven 褚崇名

每日分享科技新知、免費資源以及 WordPress、虛擬主機相關主題,任何問題歡迎在科技月球下方留言,或是發送 Email 至 [email protected] 與我聯繫。

文章: 1335

發佈留言

發佈留言必須填寫的電子郵件地址不會公開。 必填欄位標示為 *


Share to...