
免費離線語音轉文字Buzz 本地轉錄上手【免費下載鏈接】buzzBuzz transcribes and translates audio offline on your personal computer. Powered by OpenAIs Whisper.項目地址: https://gitcode.com/GitHub_Trending/buz/buzz上周的評審會開了一個半小時錄音還在文件夾里躺著誰也不想再聽一遍。Buzz 是一個離線語音轉文字工具把你的音頻文件丟進去本地跑完 Whisper 模型直接出帶時間戳的文字稿全程不需要聯網。音頻數據始終留在你自己的機器上不用注冊賬號不用按分鐘付費。它是什么憑什么不一樣Buzz 是基于 OpenAI Whisper 的開源桌面應用MIT 協(xié)議個人開發(fā)者維護。它和云端轉錄服務的區(qū)別在于兩點全程離線音頻不離開你的電腦GPU 加速NVIDIA 顯卡走 CUDAAMD 和 Intel 核顯走 Vulkan。此外本地模型從 tiny 到 large 隨便換精度和速度由你自己拿捏。Buzz 主界面拖入文件即可開始離線語音轉文字支持多任務排隊從零到第一次出結果裝上去Windows到發(fā)布頁下載安裝包雙擊運行。應用未簽名安裝時點更多信息→仍要運行。macOS下載 .dmg 文件拖到應用程序文件夾即可。Linuxflatpak install flathub io.github.chidiwilliams.Buzz或sudo snap install buzz。Python 環(huán)境pip install buzz-captions python -m buzz跑一遍打開 Buzz點工具欄圖標或按 CtrlO選一個音頻或視頻文件。在面板里選任務類型轉錄 / 翻譯成英文、語言、模型大小。點運行等狀態(tài)欄變成已完成。雙擊那一行任務轉錄查看器打開里面就是帶起止時間的文字稿。拿到什么你會得到一個可編輯的文字稿每段標注起止時間可以直接改錯字、調時間軸。導出支持 TXT、SRT、VTT 三種格式。如果轉錄時開了詞級時間戳還能用內置調整工具把文字重新切分成適合做字幕的短句。轉錄查看器支持逐段編輯、播放定位、多格式導出能干什么實時錄音轉錄麥克風講話屏幕上同步出文字錄完自動生成完整文字稿。什么時候用開會、采訪、課堂記錄想邊說邊看到文字。怎么開點頂部錄音按鈕選好麥克風和語言開始說話就行。文件夾監(jiān)視指定一個文件夾新文件丟進去就自動開始轉錄不用手動逐個導入。什么時候用每天固定收到一批錄音文件想省去重復操作。怎么開偏好設置 → 文件夾監(jiān)視勾選并選擇目標文件夾。說話人識別轉錄完成后自動區(qū)分不同說話人給每句標上 Speaker 1、Speaker 2 標簽還能試聽 10 秒片段確認身份后改名。什么時候用多人訪談、電話會議錄音需要分清誰說了什么。怎么開雙擊任務打開查看器點識別說話人按鈕。字幕調整與導出把轉錄文字按最大長度、標點、靜音間隙重新切分成字幕行導出 SRT 或 VTT 直接給視頻用。什么時候用給視頻配字幕需要控制每條字幕字數和顯示時長。怎么開查看器里點調整大小設好參數后點導出。插件擴展1.4.5 起支持插件系統(tǒng)內置 AI 摘要生成、DeepFilterNet 降噪、導出 Word 文檔等。什么時候用想在轉錄前自動去噪或轉錄后自動生成摘要存到筆記里。怎么開菜單幫助→插件勾選需要的插件并配置。模型偏好頁可下載和管理不同尺寸的 Whisper 本地轉錄模型幾個你會真實遇到的場景【給 2 小時播客剪 3 條 15 秒短視頻】先跑一遍完整轉錄拿到帶時間戳的文字稿在查看器里搜關鍵詞定位想剪的片段把對應時間段導出 SRT 丟進剪輯軟件。小技巧轉錄時打開詞級時間戳后面調整字幕長度會靈活很多。【每天 5 封客戶電話錄音歸檔】把錄音統(tǒng)一丟進一個文件夾開啟文件夾監(jiān)視Buzz 自動轉錄。配合跳過已轉錄插件同批文件重跑不會重復計算。小技巧給每個客戶建子文件夾導出模板里用{filename}變量文件名自動對得上。【課堂錄音轉講義】開實時錄音模式老師講課你這邊同步出文字。下課后雙擊任務把口語化表達改寫成書面語導出 TXT 當講義底稿。小技巧在初始提示里填幾個專業(yè)術語能明顯減少專有名詞的識別錯誤。【會議錄音多人發(fā)言分不清】轉錄完點識別說話人Buzz 按聲線把句子分組你可以試聽片段確認是誰然后把標簽改成真實姓名。小技巧保存時勾上合并同一說話人連續(xù)句子讀起來更像正常對話。調優(yōu) 常見問題??轉得太慢換小一號的模型base 或 small確認 GPU 加速已開啟。長文件用 Whisper.cpp 后端比默認后端快不少。識別準確率不夠手動選對語言比自動檢測穩(wěn)。錄音有明顯背景噪音的話先開 DeepFilterNet 降噪插件再轉錄。??怎么批量處理拖多個文件進主界面排隊依次跑或者開文件夾監(jiān)視讓文件進來自動處理。配合跳過已轉錄插件二次導入不會重復計算。模型文件占空間緩存在本地用戶目錄偏好設置→模型頁可以刪除不用的。tiny 約 75 MBlarge 約 3 GB按需保留。字幕調整界面控制每行字幕最大長度后導出 SRT跟同類工具比差在哪維度Buzz云端轉錄 API命令行 Whisper隱私? 全程本地? 需上傳? 全程本地上手成本? 圖形界面拖文件即用? 調接口? 需配環(huán)境實時錄音? 支持? 不支持? 不支持費用? 免費開源? 按量計費? 免費選 Buzz 還是選命令行取決于你要不要圖形界面和實時錄音選 Buzz 還是選云端 API取決于你的音頻能不能出內網。適合誰不適合誰適合需要處理敏感錄音、不能上傳云端的場景醫(yī)療、法務、財務有獨立顯卡、想利用本地算力的用戶需要批量處理、自動觸發(fā)、多格式導出的內容創(chuàng)作者不適合只偶爾轉一段、不想裝任何軟件的輕度用戶音頻質量極差、多人同時搶話且無法降噪的場景需要 API 接口對接其他系統(tǒng)、不想維護本地環(huán)境的開發(fā)者Linux 用戶直接flatpak install flathub io.github.chidiwilliams.Buzz就能跑起來其他平臺在發(fā)布頁下載安裝包。Buzz 做的事情很單純你的錄音不離開你的電腦文字稿在本地生成免費隨時可復現。【免費下載鏈接】buzzBuzz transcribes and translates audio offline on your personal computer. Powered by OpenAIs Whisper.項目地址: https://gitcode.com/GitHub_Trending/buz/buzz創(chuàng)作聲明:本文部分內容由AI輔助生成(AIGC),僅供參考