ARTICLE DETAIL

资讯详情

深耕郑州网站建设与运营推广的一线实战洞察。

Buzz 离线音频转录实战指南:Whisper 本地语音转文字,5 步拿到 SRT 字幕

Buzz 离线音频转录实战指南:Whisper 本地语音转文字,5 步拿到 SRT 字幕 Buzz 离线音频转录实战指南Whisper 本地语音转文字5 步拿到 SRT 字幕【免费下载链接】buzzBuzz transcribes and translates audio offline on your personal computer. Powered by OpenAIs Whisper.项目地址: https://gitcode.com/GitHub_Trending/buz/buzzBuzz 是一款开源的离线音频转录工具基于 OpenAI Whisper 模型在本地电脑上完成语音转文字与翻译音频文件不经过任何服务器无需联网也能完成主要工作。适合处理敏感录音、会议内容以及视频字幕的制作。它能做什么三项核心能力离线转录与翻译导入音视频文件或 YouTube 链接本地生成 TXT、SRT、VTT 三种格式文本覆盖上百种语言也可把语音翻译成目标语言。实时录音转录麦克风边录边转写文本实时显示可弹出独立演示窗口适合会议和演讲现场跟字幕。结果再加工转录查看器支持搜索、播放和调速Resize 工具把分句整理成字幕条插件可生成 AI 摘要或导出 DOCX 文档。从零上手安装 Buzz 并跑出第一条转录结果安装程序macOS 与 Windows 到官方发布渠道下载安装包Windows 未签名提示时选“更多信息 → 仍然运行”Linux 执行sudo snap install buzz或flatpak install flathub io.github.chidiwilliams.Buzz开发者可用pip install buzz-captions安装后以python -m buzz启动需先装 ffmpeg使用 Python 3.12 环境。下载模型首次运行会自动拉取所选模型在“帮助 → 偏好设置 → 模型”页可查看进度与存放位置。导入文件用“文件 → 导入媒体文件”菜单或按 Ctrl/Cmd O 选择一个音频或视频文件。配置任务在任务行选择 transcribe指定语言如 zh选一个后端与模型大小点 Run。打开结果状态变为 Completed 后双击该行打开转录查看器即可导出 TXT / SRT / VTT。功能速览三个高频用法本地模型与多种 Whisper 后端是什么Buzz 内置 4 种推理后端模型大小分 tiny、base、small、medium、large 五档全部在本地运行。解决什么不同电脑性能差异大可以按硬件挑选后端保证转录速度。怎么用在偏好设置的模型页下载所需模型。无独立显卡或 Mac 用户选 Whisper.cppNvidia 显卡显存 6GB 以上选 Faster Whisper需要 MMS、Parakeet 等社区模型选 HuggingFace。后端特点适用硬件Whisper原版准确但慢占内存多大内存机器Faster Whisper速度快、省内存Nvidia GPU显存 ≥6GBWhisper.cppC 实现省资源支持 Vulkan 加速任意 GPU、Apple Silicon、纯 CPUHuggingFace支持 MMS、PEFT 等定制模型任意️ 麦克风实时录音转录是什么点击工具栏录音按钮后Buzz 边录边转写文本实时显示并可弹出独立演示窗口。解决什么会议、讲座、访谈等现场需要即时文字记录来不及事后补。怎么用选好音频输入设备与语言后开始录音暂停、停止后可导出完整文本在偏好设置里开启实时转录导出文本会随生成写入 .txt 文件方便对接 OBS 等直播工具。转录查看器与字幕调整是什么双击任务行打开的编辑界面带时间轴、搜索、播放与速度调节Resize 工具负责把分句整理成字幕条。解决什么Whisper 原生生成的分句往往太短或太长不能直接当字幕用。怎么用转录时勾选 Word-Level Timings完成后点 Resize设置单条字幕最大长度、按标点断句、每段延长显示的秒数再导出 SRT/VTT。插件系统摘要、降噪与文档导出是什么从 1.4.5 版本起Buzz 提供插件机制可挂在转录流水线的前后。解决什么降噪、摘要、导出 Word 文档等收尾工作不必再依赖外部工具。怎么用在 Help → Plugins 里开关插件并拖动调整执行顺序。内置插件包括 DeepFilterNet 降噪、AI Summary经 OpenAI 兼容接口生成摘要、Export to DOCX、Enhanced Language Detection本地语言检测、Skip Already Transcribed跳过已转录文件。插件源码见 buzz/plugins/。实战一例把一段会议录音变成 SRT 字幕导入录音启动 Buzz按 Ctrl/Cmd O 导入会议录音mp3、mp4 等格式均可。配置任务任务选 transcribe、语言选 zh后端选 Whisper.cpp、模型选 base勾选 Word-Level Timings导出格式选 SRT。补充提示词人名、专业词容易识别错点 Advanced... 按钮在 Initial prompt 里填入这些词。等待完成点 Run等状态变为 Completed。整理导出双击行打开查看器核对文本点 Resize 把字幕压到可读长度导出 SRT 后导入剪辑软件。习惯命令行的用户可以直接跳过界面buzz add -s base -l zh --srt 录音.mp3完整参数见 docs/docs/cli.md。避坑答疑新手最常问的 5 个问题Q1模型文件存在哪里Linux 在~/.cache/BuzzmacOS 在~/Library/Caches/BuzzWindows 在%USERPROFILE%\AppData\Local\Buzz\Buzz\Cache也可在“偏好设置 → 模型”页点 Show file location 直达该目录。Q2转录太慢怎么办换更小的模型tiny/base或按硬件换后端无独显用 Whisper.cppNvidia 显卡用 Faster Whisper。详细说明见 docs/docs/faq.md。Q3完全断网的机器能跑吗能。先用联网机器把模型下载好再拷贝到离线机器的模型目录仓库中的 scripts/download-models.py 可以批量准备离线模型缓存。Q4想转写电脑里播放的声音而不是麦克风先配置一个虚拟音频设备macOS 用 BlackHole、Windows 用 VB CABLE、Linux 用 PulseAudio 环出再把 Buzz 的录音输入源指到它即可。Q5Buzz 崩溃或模型损坏怎么办多为模型下载不完整删掉对应模型文件重新下载即可。另外注意 CPU 需要支持 AVX2较老的机器无法运行。写在最后Buzz 把语音转文字从云端搬回本地音频不出设备流程可编辑、可导出也能用 CLI 批量化。延伸阅读常见问题 docs/docs/faq.md、偏好设置说明 docs/docs/preferences.md、命令行用法 docs/docs/cli.md、插件源码 buzz/plugins/。【免费下载链接】buzzBuzz transcribes and translates audio offline on your personal computer. Powered by OpenAIs Whisper.项目地址: https://gitcode.com/GitHub_Trending/buz/buzz创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
返回列表