Buzz离线音频转录:从装好到出文字的完整教程

发布时间:2026/9/7 23:13:53
Buzz离线音频转录:从装好到出文字的完整教程 Buzz离线音频转录从装好到出文字的完整教程【免费下载链接】buzzBuzz transcribes and translates audio offline on your personal computer. Powered by OpenAIs Whisper.项目地址: https://gitcode.com/GitHub_Trending/buz/buzz刚开完40分钟的会录音文件躺在下载文件夹里光标在闪。Buzz能在本地把这段录音变成带时间戳的文字稿整个离线音频转录过程都发生在你自己的电脑上文件不用传给任何服务器。30秒搞清楚Buzz是什么Buzz是一个开源桌面程序它把OpenAI的Whisper模型跑在你本机负责语音转文字和翻译能处理音频、视频文件也支持直接导入网页链接。它和在线转录服务最本质的区别是音频由你电脑处理而不是上传到别人服务器。在线转录服务Buzz本地转录文件去向上传到第三方服务器只在本机处理费用按量或订阅收费一次安装免费MIT开源网络依赖全程必须联网首次下完模型后可离线用语言支持看平台列表99种语言含中文、日语说白了模型下载好之后断网也能继续转。Buzz安装步骤Windows从项目官方发布页SourceForge下载Windows安装程序。运行安装若弹出未知发布者提示点更多信息选仍要运行即可程序只是没签名。macOS从官方发布页下载.dmg安装包。把Buzz拖进应用程序文件夹双击启动。Linux用Flatpak或Snap二选一flatpak install flathub io.github.chidiwilliams.BuzzSnap需要先装几个音频相关依赖再安装sudo apt-get install libportaudio2 libcanberra-gtk-module libcanberra-gtk3-module sudo snap install buzzPython安装跨平台需要Python 3.12和ffmpegpip install buzz-captions python -m buzz装好之后第一次打开先到偏好设置里的模型页把要用的转录模型下载下来下完就可以开始了。模型在这里下载跟着走一遍从音频文件到文字稿打开Buzz主界面是一个任务表格加一条工具栏一开始是空的。Buzz主界面任务列表选文件。文件菜单选导入媒体文件或直接按CtrlOMac上是CommandO弹出文件选择框选中那段会议录音。填参数。导入表单里有三个关键字段任务转写或翻译成英文、语言手动指定比自动检测稳、模型。挑模型档位。拿不准就看这张表模型档位下载体积速度准确率适合tiny约73MB最快基础快速草稿base约139MB快良好日常使用small约462MB中等更好一般录音medium约1.5GB慢高重要内容第一次跑选small就行觉得准确率不够再换大的。 4.点运行。任务进入队列状态从进行中走到已完成期间能看到进度。 5.打开结果。双击这一行或点右侧的⤢图标转录视图打开文本按时间段分行上方有播放控制点播放文字跟着音频位置走。转录结果编辑视图文字可以直接改工具栏的导出按钮能存成TXT、SRT、VTT。到这里你手里已经有一份可用的文字稿了。解锁更多用法一次转10个文件一周的采访录音散在下载文件夹里一个个点太累。导入时按住Ctrl多选文件它们会依次排队转录也可以在偏好设置里配置监控文件夹之后丢进去的音频自动开始转录。转完输出文件夹里就是一摞文字文件。边开会边出文字长时间开会手速跟不上语速。主界面选好语言、模型和麦克风点录音文字随说话实时上屏再打开演示窗口可以把实时转录投到大屏幕上。实时模式建议选Whisper.cpp引擎配较小的模型。会开完文稿已经在了。给视频加字幕转出来的SRT一行太长屏幕放不下。导入时勾选词级时间戳转完在转录视图点重新调整大小设好单行字幕最大长度、勾上按标点分行确认。字幕就被合并成时长合适的短句导出SRT直接丢进剪辑软件。字幕长度调整标记谁说了什么采访稿分不清说话人时在转录视图点识别说话人Buzz按声音把各句打上标签还能试听该说话人约10秒的语音来核对把标签改成真名。保存后每句前都带说话人标记。卡住了看这里如果模型下载卡住不动大概率是网络问题——国内网络可以设置HF_ENDPOINT环境变量指向镜像源再启动也可以手动把模型文件下到本机模型目录。如果Windows安装时弹出未知发布者蓝色警告不是中毒点更多信息选仍要运行就行。如果转录太慢先换small或base档的模型再把引擎切到Whisper.cpp速度明显更快机器旧的话用tiny也够用。如果人名、专业词总转错在导入表单点高级把常出现的词填进初始提示再跑一遍这是官方给的纠正拼写的手法。如果pip装不上先确认Python版本是不是3.12ffmpeg装没装这两个缺一不可。现在你那段会议录音打开Buzz、CtrlO选中文件、点运行几分钟后就变成带时间戳的文字稿。想长期用的人下一步去偏好设置的模型页把medium档也下了再配一个监控文件夹以后音频丢进去就自动出文字。转录全程在你机器上跑结果文件只有你自己有——这种踏实感是免费附赠的。【免费下载链接】buzzBuzz transcribes and translates audio offline on your personal computer. Powered by OpenAIs Whisper.项目地址: https://gitcode.com/GitHub_Trending/buz/buzz创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考