本機模型

本機轉錄模型和摘要模型,邊界說清楚。

HushMemo 把語音轉文字模型和摘要模型分開說明:轉錄模型負責把音訊變成文字;摘要模型負責把檢查後的轉錄整理成筆記、待辦、郵件和範本結果。

轉錄

語音轉文字模型

根據儲存、速度和準確度選擇轉錄模型。小模型更快,大模型更適合複雜錄音和更高準確度需求。

最快轉錄

Whisper Tiny

大小較小的語音轉文字模型,適合快速草稿和短語音筆記。

大小~75 MB
語言多語言
速度最快
下載手動

適合:臨時想法、短提醒、粗略草稿,以及儲存空間有限的裝置。

速度快、大小小,但在噪音、口音、長會議或專業術語情境下準確度較低。

平衡轉錄

Whisper Base

適合日常錄音的平衡型本機轉錄模型。

大小~142 MB
語言多語言
速度較快
下載自動

適合:會議、通話、課堂、訪談和需要兼顧速度的語音筆記。

下載後可作為實用預設選擇。重要轉錄在摘要或分享前仍需要人工檢查。

更高準確度

Whisper Small

準確度更高的本機轉錄模型,適合更長、更複雜的音訊。

大小~466 MB
語言多語言
速度較慢
下載手動

適合:較長會議、課堂、訪談、多說話人錄音,以及細節更多的內容。

佔用更多儲存和處理時間。長錄音仍建議分段檢查。

摘要

摘要和範本模型

轉錄完成後,本機摘要模型會把檢查後的文字整理成會議記錄、任務、郵件、學習筆記等結構化輸出。

預設推薦

Gemma 3 1B

適合日常筆記的預設本機摘要模型。

大小529 MB
脈絡2,048 tokens
執行優先使用 GPU
下載自動

適合:會議、快速摘要、待辦擷取和中短轉錄文字。

下載後本機執行。較長錄音可能需要短摘要或分段處理。

中文優先

Qwen 2.5 1.5B

中文摘要品質更高,並提供更大的脈絡視窗。

大小1.49 GB
脈絡4,096 tokens
執行優先使用 CPU
下載手動

適合:中文會議、諮詢記錄和結構更複雜的範本。

可選手動下載。檔案更大,佔用更多儲存,處理時間也可能更長。

高品質

Gemma 4 E2B

可選高品質模型,適合更長脈絡和複雜範本。

大小2.41 GB
脈絡8,192 tokens
執行優先使用 GPU
下載手動

適合:較長轉錄、深度演講分析和多章節範本。

可選手動下載。速度可能更慢,建議在儲存和記憶體較充足的裝置上使用。