Buzz 离线音频转文字实战指南:7 个场景从装好到导出字幕 📅 发布时间:2026/9/7 7:52:20 👁 浏览次数: Buzz 离线音频转文字实战指南7 个场景从装好到导出字幕【免费下载链接】buzzBuzz transcribes and translates audio offline on your personal computer. Powered by OpenAIs Whisper.项目地址: https://gitcode.com/GitHub_Trending/buz/buzzBuzz 是一款跑在你自己电脑上的音频转文字工具内置 OpenAI Whisper 模型会议录音、播客、访谈全程离线处理不用上传云端也不依赖任何在线 API。适合不想把录音交给第三方、又想要本地离线转录能力的个人和办公用户。下面按 7 个真实场景把从第一次启动到批量自动化跑顺的路一次讲清。Buzz 首次启动前的 3 项检查FFmpeg 装好了吗Buzz 靠 FFmpeg 解码音频、从视频里抽出音轨。在终端执行ffmpeg -version能打印版本号就算过关打印找不到命令就先装好再来。录音权限给到位了吗只用文件导入可以跳过这一步想用实时录音先给系统权限Windows 在设置 → 隐私 → 麦克风里放行桌面应用Linux 确认当前用户在 audio 组。权限没给设备列表里会一片空白。模型文件放哪模型首次使用时自动下载缓存在系统用户缓存目录的 Buzz 文件夹里不用手动放。单个模型几百 MB 到几个 GB第一次转录前留足磁盘空间即可。第一个音频文件怎么导入Buzz 的导入框直接接受文件路径和 URL常见音频格式 WAV、MP3、FLAC、M4A 都能直接转MP4、MKV、AVI 这类视频会自动提取音轨YouTube 或播客链接也能直接丢进去。碰到 Buzz 不认的格式用 FFmpeg 先转成 WAVffmpeg -i input.m4a output.wav一条命令换容器编码转完的文件什么工具都能吃。首次转录时 Buzz 会先下载所选模型长音频还要排队跑几分钟第一次别急着下结论。转完点进转录详情文字按片段展示点某句文字音频就跳到对应位置播放。Whisper 模型怎么选按场景对号入座模型大小决定速度和精度的平衡按你的场景挑就行不用背参数快速随手记、先试跑一遍tiny 或 base几秒出结果日常会议、播客整理base 或 small速度和精度都能接受正式文稿、多语言混杂、长访谈medium 或 large准但慢吃硬件NVIDIA 显卡用户让 Buzz 走 GPU 加速large 档的等待时间会短一大截纯 CPU 机器建议往小一档选不然长音频基本是在熬时间在偏好设置里把模型和默认语言定下来之后的每个新任务都会沿用不用每次都挑。Buzz 麦克风没声音或有杂音怎么办没声音三步排查现象点了录制电平表纹丝不动。先检查设备下拉框里有没有麦克风——没有就先解决驱动和权限有但不跳去系统混音器看输入被没被静音还不出声换一个输入源试排除设备本身故障。有杂音环境噪音大时靠近麦克风、压低增益是第一优先Buzz 的降噪插件DeepFilterNet也能进一步压掉背景噪声在插件面板里启用即可。转完的文字怎么落地SRT、TXT、JSON校对入口就是转录视图逐段改错字点哪句音频就跟到哪片段边界可以拖动把时间戳对齐到真正的起音位置。分句太长影响阅读时用片段调整功能按标点或长度重新拆分多人对话还能给片段指定说话人。导出在导出菜单里选格式SRT / VTT做视频字幕丢进播放器或剪辑软件就能用TXT纯文本发同事、贴文档最省事JSON带时间戳的结构化数据方便程序二次处理翻译结果也能按同样格式单独导出中英对照一次成型批量与无人值守命令行加文件夹监听图形界面之外Buzz 本身支持命令行转写buzz add --model-size small --srt --txt --output-directory ./out a.mp3 b.wav一行命令处理多个文件指定模型档位和输出格式输出统一落到--output-directory指的目录。想要全自动用图形界面的文件夹监听指定一个监控目录往里丢音频就会自动排进转录队列录完直接走人。批量任务建议挂个小一点的模型精度够用、队列转得快。出问题了先看这里日志与性能速查先看控制台输出从终端启动 Buzz日志会直接打在控制台转录任务的中间状态也存在用户缓存目录的 Buzz 文件夹里JSON 文件。报错时找 ERROR、Exception 关键词堆栈第一行通常就指明了问题模块。性能卡在哪首次使用某个模型必然慢下载加加载都在里面第二次就快了转录速度与模型大小、音频长度、硬件直接挂钩长录音配大模型等待时间以小时计很正常。不需要高精度的场景把模型换小一档速度能上来几倍。写在最后Buzz 和 Whisper 生态都在频繁更新模型越大越准、软件修得越多越稳保持软件与模型为最新版本能避掉一大半疑难杂症。把 FFmpeg、权限、模型这 3 件事确认完第一个文件跑通之后剩下的都是熟练度的事。【免费下载链接】buzzBuzz transcribes and translates audio offline on your personal computer. Powered by OpenAIs Whisper.项目地址: https://gitcode.com/GitHub_Trending/buz/buzz创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考