Buzz:免费离线语音转文字工具,Whisper 转录全程本地完成

📅 2026/8/27 15:21:00
Buzz:免费离线语音转文字工具,Whisper 转录全程本地完成
Buzz免费离线语音转文字工具Whisper 转录全程本地完成【免费下载链接】buzzBuzz transcribes and translates audio offline on your personal computer. Powered by OpenAIs Whisper.项目地址: https://gitcode.com/GitHub_Trending/buz/buzzBuzz 是一款免费的离线语音转文字工具基于 OpenAI Whisper在你自己的电脑上完成音频转录与翻译全程无需联网。整理会议录音时谁不想不上传音频就能出文字稿在线转录服务按量收费隐私也没底。Buzz 把处理全部留在本地音频文件永远不会离开你的设备。它能做什么 99 种以上语言本地转录中文、英文、日文等语言开箱可用装好模型后完全离线运行。转录和翻译一次完成转写的同时可生成译文比如英文采访直接产出中文文稿。导出格式现成可用支持 TXT、SRT、VTTSRT 可直接用于视频字幕。GPU 加速NVIDIA 显卡用 CUDAAMD/Intel 显卡用 Vulkan长音频处理速度明显提升。快速上手 ⚡安装Windows 下载安装包直接运行未签名安装时点仍要运行即可macOS 执行brew install --cask buzzLinux 用 Flatpak 或 Snapflatpak install flathub io.github.chidiwilliams.Buzz sudo snap install buzz导入把音频或视频拖进主界面。支持 MP3、WAV、M4A、OGG、FLAC 等音频以及 MP4、MKV、MOV、AVI 等视频视频会自动提取音频。出结果选好模型和语言点运行完成后双击任务打开查看器即可编辑并导出 TXT、SRT 或 VTT。核心功能 实时录音转录边录音边出文字发言时就能看到文稿雏形适合现场会议和访谈结束后立刻核对要点。文件夹监视指定一个文件夹新放入的音频自动排队转录当天的采访录音丢进去下班回来全是文本。说话人识别多人对话自动区分并标注说话人两人对谈能直接分出各自说了什么。模型档位可选从 Tiny 到 Large 多档模型低配机器跑 Tiny 求快重要内容用大模型求准。字幕长度调整把过长段落切分成长度合适的字幕条导出 SRT 后可直接导入剪辑软件。转录核心逻辑在 file_transcriber.py录音模式实现在 recording_transcriber.py想改行为可以从这两处入手。真实场景 记者做采访录音过程中开启实时转录现场就能得到文字草稿。回发稿前在查看器里逐段核对人名和数字。注意专业词汇多时在初始提示里写上相关术语识别会更准。视频创作者做字幕导入视频后自动提取音频并生成带时间戳的字幕。用字幕调整功能控制单条长度再导出 SRT。注意先选对语言避免自动检测把中英混说判错。研究生整理讲座把多场讲座录音集中放进监视文件夹批量转成文本后检索关键词。注意讲座时长较长时选大模型等待时间换准确率。企业会议纪要例会录音统一归档到一个目录Buzz 自动转录并区分说话人。注意会后先扫一遍译文或原稿专有名词以人工修正为准。效率技巧与常见问题 三个小技巧手动指定语言比自动检测稳准确率提升明显。日常内容用 Base 档模型即可速度和准确度的平衡点最合适重要录音再切 Large。在偏好设置里统一管理模型下载和删除都在界面里完成不用手动管文件。高频问题Q识别不准怎么办A换更高档位的模型手动指定语言并尽量降低录音时的背景噪音。Q转录太慢怎么提速A在偏好中确认已启用 CUDA 或 Vulkan 加速硬件一般时改用更小的模型。Q支持哪些文件格式AMP3、WAV、M4A、OGG、FLAC 等音频以及 MP4、MKV、AVI、MOV 等视频均可导入。Buzz 的价值在于把语音转文字变成不联网、不上传、不收费的本地操作文稿随时可改、格式随时可导出。下载后先挑一段手头的会议录音或采访音频转一次体验完速度和准确度再决定是否启用文件夹监视做自动化。【免费下载链接】buzzBuzz transcribes and translates audio offline on your personal computer. Powered by OpenAIs Whisper.项目地址: https://gitcode.com/GitHub_Trending/buz/buzz创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考