Buzz 离线语音转文字实战指南:本地音频免费转成字幕只需三步 📅 发布时间:2026/9/7 20:13:18 👁 浏览次数: Buzz 离线语音转文字实战指南本地音频免费转成字幕只需三步【免费下载链接】buzzBuzz transcribes and translates audio offline on your personal computer. Powered by OpenAIs Whisper.项目地址: https://gitcode.com/GitHub_Trending/buz/buzz你的会议录音散落在手机、电脑和 U 盘里想转成文字又不放心把敏感内容交给在线服务Buzz 基于 OpenAI Whisper把整个语音转文字过程放在你自己的电脑上跑导入音频、点运行得到带时间戳的文本和字幕全程不出本机。为什么选 Buzz五个值得留意的点音频不出设备模型和推理都在本地运行涉密录音、客户访谈可以放心处理。免费且开源不订阅、不按分钟收费支持 99 种以上语言的转写与翻译成英文。离线可用只需首次联网下载模型之后断网照常工作。界面与命令行双通道日常用图形界面点两下就行批量任务可以写进脚本。覆盖录音到字幕的全流程实时录音出字、说话人区分、字幕拆分导出都内置不需要再拼一堆外部工具。一条命令跑起来安装与启动最省心的路径是 Python 环境建议 3.12并先装好 ffmpegpip install buzz-captions python -m buzz不想折腾环境的话Windows 装官方安装包首次运行遇到未签名应用提示点更多信息→仍要运行即可macOS 下载 DMG 拖进应用程序Linux 用flatpak install flathub io.github.chidiwilliams.Buzz或 snap 包。想跟进最新功能克隆源码即可git clone https://gitcode.com/GitHub_Trending/buz/buzz。三步把一段音频变成文稿适合单人访谈、课程录音、手机备忘音等单声源材料。点工具栏图标或文件菜单导入音频Buzz 对 MP4、MKV 等视频文件会自动抽取音轨。任务选转录语言建议手动选——自动检测只看开头几秒选错整段都会跑偏。选好模型点运行状态变成已完成后双击这一行。打开查看器后播放器逐句对齐文字你可以边听边改需要修正易错的人名、产品名时在高级设置的初始提示里列出来再导出一份 TXT 就齐活了。多人对话自动区分并标注说话人适合多人访谈、播客、小组讨论——最终文稿要能看出谁说了什么。先按普通流程完成转录双击打开查看器。点识别说话人Buzz 会把每句话打上说话人标签。试听任意一句的 10 秒片段确认无误后把自动标签改成真实姓名若勾选合并同一说话人的连续句子同一段发言会合成一个段落读起来更像人工整理的纪要。注意说话人识别依赖本地音频文件仍在原位置且 macOS Intel 版本暂不支持。从录音到成品字幕词级时间戳 字幕拆分适合给视频配字幕要直接进播放器或剪辑软件。导入视频文件在高级设置里打开词级时间戳。转录完成后点调整大小可以按最大字幕行长度、是否在标点处断句来组合字幕只要原音频还在Buzz 还会分析静音间隔让断行更贴合语流。若嫌每条字幕停留太短可给每段加几秒的延长量不会侵入下一条的起点。导出 SRT 或 VTT即可挂载到视频上。不用手动点文件夹监视与批量命令适合录音固定投进某个归档目录或希望流程可脚本化。文件夹监视在偏好设置里指定一个目录新文件一放进去就自动生成转录任务再启用跳过已转录文件插件同一批文件重复导入时直接复用旧结果不重复跑模型。命令行一条命令完成转录并导出 SRTbuzz add --task transcribe --model-size small --srt /path/to/audio.mp3参数较多时看buzz add -h官方文档里也有完整列表。让识别更快更准的几个开关换后端模型类型切到 Whisper.cpp 能吃到 GPU 加速——Nvidia 走 CUDAAMD/Intel 走 Vulkan显存紧张时选 q_5 这类量化模型或在偏好设置里开 8 位量化压低显存占用。按场景选模型草稿和实时录音用 base / small 控制延迟终稿校对再上 medium / large 换准确率。手动定语言已知语种就别交给自动检测误识别率明显更低。初始提示把人名、术语、产品名写进提示专名拼写会稳定很多。噪声环境勾选语音提取先分离人声或用 DeepFilterNet 插件先降噪再转录。环境变量CPU 速度不理想可调BUZZ_WHISPERCPP_N_THREADS改线程数老显卡开加速反而更慢时设BUZZ_FORCE_CPUtrue国内下载模型慢设HF_ENDPOINT指向 hf-mirror.com 镜像。谁该用谁可以不用维度Buzz云端转录服务纯命令行 Whisper 脚本音频存放位置本机不上传需传到服务器本机网络要求仅首次下载模型必须联网离线费用免费按量计费免费操作方式图形界面 命令行网页仅命令行实时录音出字支持支持不支持适合你如果你处理的是不想外传的录音、需要字幕产出、又希望操作尽量傻瓜化不必用它如果你是全云端工作流用户或者只需要一次性脚本化转录且能接受纯命令行。延伸阅读CLI 参数全集docs/docs/cli.md偏好设置详解docs/docs/preferences.md转录引擎源码buzz/transcriber/插件系统源码buzz/plugins/【免费下载链接】buzzBuzz transcribes and translates audio offline on your personal computer. Powered by OpenAIs Whisper.项目地址: https://gitcode.com/GitHub_Trending/buz/buzz创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考