
Buzz 音频转录完全指南5 步上手从下载到导出字幕【免费下载链接】buzzBuzz transcribes and translates audio offline on your personal computer. Powered by OpenAIs Whisper.项目地址: https://gitcode.com/GitHub_Trending/buz/buzzBuzz 是一款免费开源的桌面工具基于 OpenAI 的 Whisper 模型在你自己的电脑上离线完成音频转文字和翻译——数据不出本机不依赖在线服务。它适合两类人需要把录音、视频变成文字稿的普通用户以及要做字幕、整理访谈内容的创作者。最短路径5 步拿到第一份转录结果下载安装包。Windows 和 macOS 从官方发布渠道下载安装程序Linux 用户运行下面任一命令flatpak install flathub io.github.chidiwilliams.Buzzsudo snap install buzz启动 Buzz选择 Whisper 模型。首次使用会提示下载模型电脑配置低选 tiny 或 base快、省资源追求准确率选 large-v3慢、占内存多。Whisper 是 OpenAI 开源的语音识别模型尺寸越大识别越准、消耗也越大。导入音频点菜单栏 File → Import Media File或工具栏 按钮快捷键 Ctrl/Cmd O支持 mp3、wav、m4a、ogg、flac、mp4、mkv、avi 等常见音视频格式。设置任务与语言Transcribe 按原语言出文字Translate to English 直接出英文语言建议手动指定自动检测偶尔会猜错。点 Run状态变为 Completed 后双击该行即可在转录查看器中看到带时间轴的文字稿。⚠️ 首次转录前把模型下载好之后断网也能用这就是 Buzz 离线转录的关键前提。核心工作流三种输入场景用本地文件转录入口是工具栏 按钮或 File → Import Media File。文件出现在任务列表里每行可以单独设置模型、语言、任务类型所以同一份列表里可以混着跑不同参数的任务批量处理时不用来回改设置。点 Run 后进度在列表内显示完成后双击打开结果。点导入对话框旁的 Advanced… 还能改三件事Initial prompt初始提示填入容易写错的人名、专业术语模型会照着纠正拼写、Export As导出为 TXT、SRT 或 VTT、Word-Level Timings词级时间戳为后续字幕合并做准备、Extract speech先把人声从噪音里分离出来再转录嘈杂录音更准。导入网络视频链接转录点 File → Import URL粘贴 YouTube 等平台链接Buzz 自动下载音频并开始转录不用自己先存文件。实时录音转录主界面选好任务、语言和麦克风点 Record 开始说话文字实时出现再点停止即保存。开会、讲座、采访时可以打开 Presentation window展示窗口把实时字幕投到大屏幕上。实时转录比离线转写更吃性能选 Whisper.cpp 后端加较小尺寸的模型普通笔记本的核显甚至纯 CPU 都能跟上。结果加工编辑、合并字幕与导出结果出来只是开始。双击任务列表中的条目进入转录查看器可以直接改文字、逐段调整起止时间也可以用播放条边听边校对。用 Resize 合并字幕如果当初勾选了 Word-Level Timings字幕就是一行一个词需要先合并。查看器里点 Resize设置每行最大字符数一般 40 到 50、是否按标点断开还能给每段字幕统一加几秒停留时间点 Merge 后 Buzz 自动重新分段原文件还在时会分析静音间隙让断句更准。导出成不同格式查看器右上角有导出菜单核心格式是 TXT纯文字稿、SRT字幕最通用、VTT网页视频字幕装了相应插件后还能出 DOCX、CSV。翻译结果可以和原文分别导出。字幕投视频选 SRT写文档粘贴选 TXT网页播放器选 VTT。避坑与调优转录太慢→ 原因Whisper 模型本身计算量大模型越大越慢 → 操作换小一号的模型或在偏好里把 Whisper 类型换成 Whisper.cpp兼容各种显卡和纯 CPUN 卡显存 6GB 以上则选 Faster Whisper速度快几个数量级。详见 官方 FAQ。点 Record 报 PaErrorCode-9999→ 原因系统禁止应用访问麦克风 → 操作Windows 到 设置 → 隐私 → 麦克风 里给 Buzz 放行同时留意杀毒软件拦截。Buzz 启动就闪退→ 原因模型文件下载不完整或损坏也可能是 CPU 太老不支持 AVX2 指令集→ 操作在 帮助 → Preferences → Models 里删掉对应模型重新下载。想在完全离线的电脑上用→ 原因模型只在首次转录时联网下载 → 操作在有网机器上先下载模型然后把整个模型缓存目录拷到离线电脑Linux 是~/.cache/BuzzmacOS 是~/Library/Caches/BuzzWindows 在%USERPROFILE%\AppData\Local\Buzz。下一步Buzz 把音频变文字整条链路——转录、翻译、编辑、合并字幕、导出——全部搬进了本地免费且离线。建议你先拿一段一分钟的录音跑一遍 tiny 和 large-v3 两个模型对比准确率差多少再决定日常用哪个然后按上面流程导出一份 SRT 试试字幕效果。【免费下载链接】buzzBuzz transcribes and translates audio offline on your personal computer. Powered by OpenAIs Whisper.项目地址: https://gitcode.com/GitHub_Trending/buz/buzz创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考