
Buzz 离线语音转文字工具3 步跑通第一条转录全程无需联网【免费下载链接】buzzBuzz transcribes and translates audio offline on your personal computer. Powered by OpenAIs Whisper.项目地址: https://gitcode.com/GitHub_Trending/buz/buzzBuzz 是一款基于 OpenAI Whisper 的免费开源离线转录工具模型全部运行在你的电脑上能把音频、视频转成可编辑的文本和字幕文件。它适合需要处理会议录音、采访素材或课程内容又不想把音频上传到云端的人下面按实际使用顺序讲一遍。适不适合你Buzz 的识别、翻译都在本地完成音频不经过任何服务器但性能也完全取决于你手里的硬件先对照四个条件判断 隐私要求处理敏感内容、单位要求数据不出内网时本地处理是刚需如果无所谓上传云端其他在线服务也够用。网络条件只有首次下载模型需要联网之后可以断网使用。仓库提供了 scripts/download-models.py 脚本可在一台联网机器上备好模型拷贝到离线机器使用。硬件条件较新的 CPU 和带核显的笔记本都能跑有 NVIDIA 显卡则明显更快太老的机器CPU 不支持 AVX2 指令无法使用。局限大模型更准但下载体积以 GB 计转录速度也有上限一条一小时录音在纯 CPU 上可能要等相当久别指望实时出稿。完成第一次转录按真实顺序走一遍安装 → 导入 → 选模型 → 运行 → 导出。各系统安装方式Windows到项目 Releases 页下载安装程序双击运行。应用未签名安装时如提示安全警告选更多信息 → 仍要运行即可。macOS下载.dmg拖入 Applications也可以直接用 Homebrew 安装 buzz 的 cask 包。Linux一条命令装 Flatpak 版本或改用 Snapsudo snap install buzz。从导入到导出的完整操作导入音频点工具栏按钮或 Ctrl/CmdO选择音频或视频文件预期结果是任务队列里多出一条待处理记录。选模型CPU 为主选 Whisper.cpp 后端再定一个模型大小参考下节表格语言一栏直接指定语种不建议留自动检测。运行点 Run等状态变为 Completed期间可继续导入其他文件排队。导出双击结果行打开查看器选 TXT、SRT 或 VTT 保存文本可直接编辑后再导出。转录更快更准除模型大小外后端Whisper、Faster Whisper、Whisper.cpp的选择同样影响速度和内存占用 ⚡。常见 Whisper 系列的取舍如下体积以实测常见值为准模型体积速度准确率适用场景Tiny约 75MB最快基础实时转录、低配设备Base约 142MB快良好日常速览Small约 466MB中等优秀多数正式场景Medium约 1.5GB较慢高对质量有要求、硬件够Large约 3.1GB最慢最高专业级、离线精转按你的硬件挑后端NVIDIA 显卡显存 ≥ 6GBFaster Whisper CUDAWindows 安装包已内置 CUDA 支持。其他显卡或核显Whisper.cpp可走 Vulkan 加速Mac 上首选它。纯 CPUWhisper.cpp 也可跑线程数默认是 CPU 核心数的一半调高线程未必更快不建议盲目拉满。显存吃紧时可在偏好设置里选 Whisper.cpp 的量化版本如q_5内存占用更小。用到实际业务里三个高频场景的配置建议照着设即可会议记录指定会议语言人名、项目代号写进高级里的初始提示能明显减少错拼导出带时间戳的 TXT。视频字幕导入 MP4 时开启逐词时间戳转录完点Resize按静音间隔和标点重新断句控制单行长度再导出 SRT。批量转录在偏好里开启文件夹监控放入新音频自动按默认参数转录再启用Skip Already Transcribed插件避免重复跑同一批文件。内置插件AI 摘要、字幕重排、降噪等的源码都在 buzz/plugins/ 目录各插件说明见 docs 插件文档 。避坑手册问题转录太慢。→ 换小一档模型或改用 Whisper.cpp 后端NVIDIA 显卡确认已启用 CUDA。问题识别率低、专有名词总错。→ 别用自动检测语言显式指定语种并把常错词写进初始提示。问题文件导入失败。→ 用 ffmpeg 先转成 MP3、WAV、FLAC 等常见格式再导入。问题下载模型后程序崩溃。→ 模型文件多半没下完整到帮助 → 偏好设置 → 模型里删除重下。想批量跑脚本装了 pip 版pip install buzz-captions后可用一条命令转录两个音频并直接导出 SRT/VTTbuzz add --model-type whispercpp --model-size small --srt --vtt a.mp3 b.mp3。先用一小段音频把整条流程跑通再拿同一段素材对比两三个模型大小选定你的默认档位批量任务稳定后再考虑开启文件夹监控。【免费下载链接】buzzBuzz transcribes and translates audio offline on your personal computer. Powered by OpenAIs Whisper.项目地址: https://gitcode.com/GitHub_Trending/buz/buzz创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考