Hi Speaking 免費英語跟讀工具,自備 mp3 字幕本機練口說

Hi Speaking 是免費英語跟讀工具,麥克風偵測、播放與字幕同步都在瀏覽器內完成,音檔不上傳伺服器;實測自備 mp3 與 srt 字幕就能練,但公開教材庫的後端已經暫停、條款與隱私頁也不存在,把它當本機跟讀播放器最穩。

用 AI 摘要這篇文章:

想練英語跟讀(shadowing,聽一句、跟著唸一句的練法)的人,多半遇過同一個小麻煩:播放器要一直騰出手去暫停、倒轉、再播,練沒十分鐘,注意力都花在操作上。Hi Speaking 這個免費網站工具給的答案很直接,用麥克風偵測你的聲音來推進練習,手全程不用碰鍵盤,讓你把精神放在耳朵和嘴巴上。我實際把網站從頭到尾走了一遍,也讀了它載入瀏覽器的程式碼,先講結論:它的跟讀引擎是真的、而且完全在你自己的瀏覽器裡跑;但今天打開它的首頁,公開教材庫是空的,要用的話得自己帶音檔和字幕檔。這篇把能用什麼、不能用什麼一次攤開。

先講今天打開它會看到什麼

hispeaking.com 的介面只有兩個入口:Audio Library(教材庫)與 Audio Upload(上傳)。聽起來像一個打開就有現成內容的學習站,實際狀況要先說清楚:我造訪時,教材庫頁面只留下一個 Public Library(公開庫)標題,底下沒有任何項目。開瀏覽器的開發者工具看連線紀錄,頁面其實有去向它的後端要資料,只是那台伺服器已經停擺,這段下面會細講。

Hi Speaking 官方首頁 Audio Library 畫面,Public Library 標題下方空白,沒有任何教材項目Pin
Hi Speaking 首頁的公開教材庫,實測當天是空的(2026 年 9 月)

所以現在要用 Hi Speaking,實際路徑是右邊那個入口:上傳你自己的 mp3 音檔,配上 srt 字幕檔,練習頁就會把兩者對起來。上傳頁寫得很明白:「音檔會存進你的瀏覽器本地儲存空間,不會存到伺服器」。換句話說,教材由你自備,檔案留在你機器上,站方伺服器不經手內容。這個設計在隱私上是加分,在內容上就是它今天唯一走得通的路。

我把一個音檔和字幕丟進去,練習頁動起來了

我用系統內建的語音合成做了一段約六秒的英語音檔,三個句子,再手寫一份對應的 srt 字幕(時間軸對齊每句起迄)。上傳流程很短:頁面上兩個虛線方塊,一個收音檔、一個收字幕,把檔案拖進去或點選都行,選好會打綠色勾勾,按一下 Upload to Browser Storage,右側清單就出現這組檔案,點它直接進練習頁。全程沒有帳號、沒有信箱、沒有廣告插頁。

練習頁的長相樸素但齊全:上方是音檔標題與兩個模式分頁,中間一條波形播放器,下方照 srt 時間軸列出三個句子。按播放,波形上的綠色進度線開始走,走到哪一句,那一句就即時變成藍底粗體、前面的小圓點轉綠。我停格在播放到四成左右的位置確認過,高亮的正是當下那句,對得很準。字幕同步這件事它做到了,跟讀時眼睛跟耳朵有同一個錨點,練長句的時候這個錨點比什麼都重要。

Hi Speaking 練習頁實測畫面,波形播放器進度線走到四成處,第一句字幕呈現藍底粗體高亮Pin
Hi Speaking 練習頁實測:播放中字幕即時高亮,與波形進度同步(2026 年 9 月)

檔案準備上有個小規矩:音檔收 mp3、字幕收 srt,兩個檔名要一致才會被配成一組。程式碼裡其實另留有 lrc 歌詞格式的解析器,看得出開發者設計時考慮過帶時間標記的歌詞檔,但上傳介面只開放 srt 這一條路,想用 lrc 的人現在沒有入口。另一件要記得的事:檔案存在瀏覽器的本地儲存裡,意味著換一台電腦、換一個瀏覽器,或清掉網站資料,清單就歸零,教材要自己留備份。上傳頁也提供 Clear Uploaded File 讓你手動清掉,隨傳隨練、隨清隨走,跟「檔案不落地伺服器」的設計是同一套邏輯。

兩個模式分頁值得看一眼:Auto 與 Mannual。後者是把 Manual 拼錯了,這種小地方透露出這是一個人自己做的專案,下面談身世時會再印證。兩個模式的差別在推進方式:Auto 的設計是麥克風收到你跟讀的聲音後自動走到下一句,全程不碰鍵盤;Mannual(手動)就是傳統播放器邏輯,自己按、自己等。我在測試環境裡餵的是合成音,Auto 模式的真人聲推進手感無法代為驗證;播放與字幕同步實測是通的,兩個分頁都在,切換後的行為我沒有逐一驗。

Hi Speaking 練習頁初始畫面,標題與 Auto、Mannual 兩個模式分頁,下方列出三句英文字幕Pin
自備 mp3 與 srt 進入的練習頁,含 Auto 與 Mannual(原文拼法)模式分頁(2026 年 9 月)

它的語音偵測跑在你的瀏覽器裡,不經過雲端

「AI 偵測你的跟讀」聽起來像把聲音傳到某個大模型去分析,我把網站載入的程式碼翻出來看,實際架構更乾淨:整個練習頁的主要邏輯打包在一個約 612KB 的檔案裡,裡面帶著 Silero 語音活動偵測(VAD,Voice Activity Detection)的引擎程式碼,模型檔會在進練習頁時從公共 CDN 下載到你的機器,再透過 onnxruntime-web 這套瀏覽器內推論引擎直接在你的機器上跑;麥克權限走瀏覽器標準的 getUserMedia,錄音的合併、重取樣、編碼也都在本地完成。我實測時打開練習頁,控制台確實出現模型載入完成的紀錄,整包程式碼裡找不到任何把音訊往外送的端點。

這對使用者有兩層意義。隱私上,你的聲音不出自己機器,跟讀練習這種會持續收音的場景,這點比多數要登入、要上傳的口說 App 令人安心。功能上要認清它的邊界:VAD 判斷的是「現在有人聲活動」,你唸得標不標準、單字有沒有唸錯,它不評分、也沒有任何矯正機制。把它想成一位幫你顧節奏的陪練員,你出聲它就等、你停它就走;至於唸得好不好,還是要靠自己的耳朵對著原音校正,或另外找有評分機制的工具補這一塊。順帶一提,模型檔是進頁面時才下載到你機器上開始運算的,所以第一次進練習頁會多一點載入時間,之後瀏覽器有快取就順了。

給不熟這類技術的讀者一句白話:所謂瀏覽器內推論,就是讓瀏覽器載入一個很小的聲音判斷模型(這裡用的是開源的 Silero),聲音進麥克風後直接在你電腦上算出「有沒有人在說話」,運算全程不經過外部伺服器、聲音也不外送。這類模型的判斷就那一件事,它不知道你說了什麼,也就不可能告訴你說得好不好。理解這一點,對這個工具的期待就不會放錯位置。

流量統計方面,頁面載入了 Plausible 與 Cloudflare Insights 兩套分析腳本,都是頁面層的造訪統計,與你的音檔和麥克風無關,這點從連線紀錄可以對得上。

空的教材庫背後,是一台被暫停的免費伺服器

首頁為什麼是空的,答案在連線紀錄裡:教材庫會去向 hispeaking.onrender.com 要一份公開清單,我直接打那個位址,得到的是 Render 平台的「Service Suspended」頁面,狀態碼 503。Render 是常見的平價雲端託管服務,免費方案有個出名的特性,服務一段時間沒活動或超出免費額度,平台會把它暫停,要站長自己登入喚醒或升級。網站前端攔不到資料,瀏覽器只留下一段連線失敗的錯誤訊息,教材庫就只剩下標題。後端是哪一天開始暫停的,頁面上沒有線索,我只能確認今天的狀態就是如此,也不知道站長會不會把它喚醒。

這件事對使用者的含義比「暫時沒教材」更大:這個工具的內容供給繫在一台免費層的伺服器上,而整個專案看起來是個人作品。網域註冊資料顯示 hispeaking.com 在 2024 年 11 月註冊,到期日是 2026 年 11 月,目前還沒看到續約紀錄。網站上找不到開發者是誰的自我介紹,也沒有連向任何公開的專案頁面,問責對象從缺。好消息是前面實測過的本地引擎不依賴那台伺服器,音檔、字幕、播放、偵測全在你的瀏覽器裡完成;只要網站前端還開著,自備教材的用法就繼續成立。但把長期練習計畫整個押在一個人的免費專案上,風險要自己衡量,教材與進度都留在自己機器才是穩做法。

登入頁還穿著模板,條款與隱私頁不存在

程式碼裡其實有完整的登入、註冊、驗證碼頁面,我直接造訪登入頁,看到的畫面透露的訊息不少:頁面標題就叫 Shadcn Admin,左側掛著一段範本見證「這套元件庫幫我省下無數小時」,署名 Sofia Davis,下方是電子郵件、密碼輸入框,再加 GitHub 與 Facebook 登入按鈕。這是開源後台模板 shadcn-admin 的原始示範頁,幾乎原封不動,還沒換上 Hi Speaking 自己的文案。登入按鈕下方寫著「登入即同意我們的服務條款與隱私政策」,兩個連結點進去都是 404,條款與隱私頁根本不存在。

小地方也一致:首頁的網頁描述把 supports 拼成 sppports,練習頁把 Manual 拼成 Mannual。這些不是致命傷,但疊起來看,帳號系統與法律頁面都停在未完成狀態。網頁描述裡宣稱支援間隔重複與個人化學習,實測的介面裡我沒有見到對應功能,這句先當作者的願景描述看,不要當規格。那兩個 GitHub 與 Facebook 社群登入按鈕,也是模板附帶的裝飾,沒有接任何動作;登入表單在程式碼裡只是把輸入印到開發者主控台的範本殼,還沒接上任何後端。對一般使用者的實際影響倒很有限:自備教材的用法完全不需要帳號,密碼也不用交給一台前途未卜的登入系統。

自備教材的人能用,等平台餵內容的人先繞道

整理成三層現況,方便對號入座:

層現況對你的意義
本地跟讀引擎音檔字幕同步實測可用;麥克偵測在瀏覽器內本機運行值得拿來用的部分
公開教材庫後端暫停,頁面空白內容要自備,別依賴
帳號與條款模板登入頁、條款隱私頁 404不登入、不交資料,照樣能用

適合的人很明確:已經有跟讀素材(播客或有聲書的錄音),想要一個不用安裝、聲音也不外流的免費播放器,幫自己顧住「聽一句、跟一句」的節奏。素材從哪來可以發揮:搭配文字轉語音工具把想練的英文稿先唸成音檔,例如 Edge TTS 文字轉語音 或 SpeakIt 以 Azure 語音合成 產生的音檔配字幕,就是自製教材的一條路;想找現成的口說練習素材,可以看之前整理的 Google Translate 口說練習用法。不適合的人也一樣明確:想要打開就有分級教材庫的人、想要發音評分與建議的人、想要帳號與進度紀錄的人,這三種期待今天的 Hi Speaking 都給不了。

用之前兩個動作建議先做:確認瀏覽器能給麥克權限(Auto 模式會用到,屆時瀏覽器會跳出權限詢問,記得允許),以及把你的音檔與 srt 準備成同檔名一組。字幕檔沒有的話,網路上有不少從音檔自動產生 srt 的免費工具,先產出再微調時間軸,半小時內能搞定一份可用的教材。要不要依賴它,判斷標準只有一條:把它當免費的本機跟讀播放器,它稱職;把它當學習平台,現在的它撐不起這個詞。

Sliven 褚崇名
Sliven 褚崇名

每日分享科技新知、免費資源以及 WordPress、虛擬主機相關主題,任何問題歡迎在科技月球下方留言,或是發送 Email 至 [email protected] 與我聯繫。

文章: 1545

發佈留言

發佈留言必須填寫的電子郵件地址不會公開。 必填欄位標示為 *


Share to...