Buzz 语音转录:零上传,5 分钟跑出第一条字幕

发布时间:2026/9/7 18:16:44
Buzz 语音转录:零上传,5 分钟跑出第一条字幕 Buzz 语音转录零上传5 分钟跑出第一条字幕【免费下载链接】buzzBuzz transcribes and translates audio offline on your personal computer. Powered by OpenAIs Whisper.项目地址: https://gitcode.com/GitHub_Trending/buz/buzz周一下午三点文件夹里躺着四段会议录音加起来两小时。手工听写要听到天黑上传到云端转录服务又意味着公司内容离开你的电脑。Buzz 是一个本地语音转录工具音频和模型都在你自己的机器上识别全程离线直接产出带时间戳的文字稿和字幕文件。Buzz 是什么首次启动怎么配置Buzz 是把 OpenAI Whisper 模型系列放到你个人电脑上的语音转文字工具音频不上传模型本地运行支持识别和翻译近百种语言。安装分两条路。GUI 路线macOS 下载 dmg 双击安装Windows 运行官方安装程序Linux 用 Flatpak 或 Snap 一键安装。CLI 路线git clone https://gitcode.com/GitHub_Trending/buz/buzz cd buzz pip install -e . python -m buzz第一次打开主界面第一个关键配置项是任务面板里的 Model机器一般选 Tiny有显卡再考虑 large-v3。选定后模型会自动下载到本地缓存之后使用不再重复下载。一条音频的完整旅程从拖入到导出输入拖入文件与任务队列在主界面任务区拖入音频或视频文件MP3、WAV、FLAC、M4A、MP4 等常见格式都可以也可以直接填一个网络链接。多个文件依次入队逐个处理每行状态实时显示排队中、转录中或已完成。命令行下用add子命令可以把同一套任务放到后台跑不必守着窗口。识别模型与后端怎么选每个任务单独设置模型类型Whisper、Whisper.cpp、Faster Whisper、Hugging Face 等和模型大小Tiny 到 Large-v3语言可选自动检测或手动指定任务本身有 Transcribe照原文转写和 Translate转成目标语言两个选项。高级设置里还能填初始提示词帮助模型识别专有名词。精修逐句编辑与说话人分离双击完成的任务进入转录查看器逐句修改文字拖动时间轴调整每段的起止时间也可以按时间间隔或标点做字幕式的拆分与合并。多人对话时开启说话人分离查看器会把不同人标记出来省去对照录音逐段归属的功夫。输出导出格式与命名模板导出菜单提供 TXT、SRT、VTT 三种格式SRT 和 VTT 带时间戳可以直接丢进剪辑软件。菜单里原文转录和译文分开导出翻译过的稿子不用二次处理。导出文件名由模板控制默认组合了原始文件名、任务类型和时间戳。会议、字幕、研究三类用法怎么选配置如果你主要转写会议录音选 small 档模型打开说话人分离开关。速度让位于区分谁说了什么整理纪要时省掉回听归因的环节。如果你主要给视频做字幕Whisper.cpp 加 base 或 small 档输出选 SRT。导出后进查看器微调时间轴交给剪辑软件即可。如果你主要处理批量讲座或访谈large-v3 模型配合偏好设置里的文件夹监控。录音丢进固定目录自动入队不用一个个拖。跑得快还是跑得稳硬件与后端对照表同一批模型在不同后端下速度和内存表现不同先对号入座再选配置配置档位推荐后端推荐模型注意事项8G 内存仅核显Whisper.cppbaseC 实现内存占用最低这个档位跑不动 large16G 内存无独立显卡Faster Whispersmall纯 CPU 运行速度可接受32G 内存 Nvidia 显卡Faster Whisperlarge-v3开启 CUDA 后速度明显提升Apple Silicon MacWhispersmall / mediumM 系列原生支持首次加载模型较慢属正常拿不准就从 base 起步识别结果够用就停在这档专名和数字错得多时再升一档不必一开始就冲大模型。往深处走插件、文件夹监控与模板变量以下功能日常用不上需要时再查插件机制Buzz 自带一批官方插件AI 摘要、DeepFilterNet 音频预处理、增强语言检测、DOCX 导出、跳过已转录、转录调整器在插件设置对话框里开关。每个插件的源码在buzz/plugins/下独立成目录插件系统支持动态加载。文件夹自动监控偏好设置对话框中有独立的文件夹监控页指定目录后新音频落入即自动转录。导出文件名模板在偏好设置的 Default export file name 里调整{{ input_file_name }}、{{ task }}、{{ date_time }}三个变量的组合。国际化文件各语言翻译以 .po 格式放在buzz/locale/对应语言目录下想加语言或改措辞从这入手。动手前可能想问的三个问题Q8G 内存能跑 Large 吗A基本不行。Large 系列内存占用高这个档位用 Whisper.cpp 加 base 或 small等有独立显卡再上 large 系列。Q没有显卡能不能跑A能。本地后端全部支持纯 CPU 运行其中 Whisper.cpp 对内存最友好速度不满意时降模型档位比换机器划算。Q导出的 SRT 能直接用于剪辑吗A能。SRT 和 VTT 都是标准时间戳字幕格式导出后无需转换即可导入主流剪辑软件和播放器。装好后第一个动作就是把最近一段播客拖进任务队列选 base 模型等第一份带时间戳的 SRT 出来——之后你会知道哪些档位值得为它升级。【免费下载链接】buzzBuzz transcribes and translates audio offline on your personal computer. Powered by OpenAIs Whisper.项目地址: https://gitcode.com/GitHub_Trending/buz/buzz创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考