
Buzz 本地音频转录指南在自己的电脑上完成语音转文字【免费下载链接】buzzBuzz transcribes and translates audio offline on your personal computer. Powered by OpenAIs Whisper.项目地址: https://gitcode.com/GitHub_Trending/buz/buzzBuzz 是一款开源的本地音频转录与翻译工具基于 OpenAI Whisper 在本地运行录音不上传任何服务器敏感会议、采访内容直接变成文字稿件和原始文件都留在你自己的设备上。 Buzz 项目速览项目内容定位离线音频转录与翻译的桌面应用解决的问题语音转文字但不希望敏感音频上传云端或在离线环境中处理录音适合谁做会议纪要的人、需要字幕的创作者、有隐私要求的用户是否收费MIT 协议开源无付费订阅系统支持Windows、macOS、Linux Buzz 如何安装并跑出第一次转录不同系统的安装方式不同macOS从官方发布页下载.dmg安装器双击安装Windows从发布页下载安装文件程序未签名安装时需点“More info - Run anyway”Linux用 Flatpak 安装flatpak install flathub io.github.chidiwilliams.Buzz也可以先用 apt 装好音频依赖libportaudio2 等再走 Snapsudo snap install buzzPython 3.12 环境同样可行需先装好 ffmpegpip install buzz-captions python -m buzz启动后在新建任务对话框里选择音频文件或粘贴 YouTube 链接挑选模型、任务转录或翻译成英语、语言和导出格式点 Run。首次运行会自动下载模型之后即可离线使用。 功能拆解Buzz 能做什么转录、翻译与三种导出格式Buzz 可直接转录音视频文件和 YouTube 链接支持中文、英语、日语、法语等 99 种以上语言处理外语资料时选“翻译成英语”任务可以直接拿到英文文本。导出格式为 TXT、SRT、VTT分别对应文稿和字幕两类用途。实时录音与系统声音选择麦克风即可实时转录并附带一个演示窗口方便在讲座、活动场合投屏如果想转写电脑正在播放的声音需要把系统声音接入虚拟声卡macOS 用 BlackHole、Windows 用 VB-Cable 之类再选它作为录音源。查看器、监控文件夹、CLI 与插件转录查看器里可以搜索、调整播放速度并逐段修改文字监控文件夹会自动对丢进去的新文件开始转录命令行接口 buzz/cli.py 支持--model-size、--language、--srt等参数适合写脚本批量处理插件系统还提供 AI 摘要、字幕自动调整长度等扩展能力。 场景实战会议纪要与课程字幕一位产品经理拿到 2 小时的会议录音下午就要纪要。他把录音导入选 Medium 模型跑完在查看器里改掉几个产品名和人名导出 TXT。会议内容比较敏感整个过程都在本机完成文件没有离开过这台电脑。做在线课程的创作者有 3 小时录屏要生成 SRT 字幕。长音频选 Turbo 或 Large-V3-Turbo 这类兼顾速度与准确率的模型比直接上最大模型更划算显存不够就改用 Whisper.cpp 后端普通笔记本 CPU 也能跑。字幕生成后用调整工具把过长的段落拆开再导出给视频平台。⚙️ 转录模型怎么选速度与准确率官方 FAQdocs/docs/faq.md的结论很直接小模型快但错得多大模型准但更吃硬件和时间唯一的可靠办法是用自己的语言实测。模型定位Tiny速度最快用于快速出草稿Base / Small速度与准确率平衡日常够用Medium准确率更高适合正式文稿Large-V2 / Large-V3V2 稳定V3 多数情况最准但偶尔会产生幻觉词Turbo速度与准确率均衡适合长音频选后端whisper 类型的影响往往比选模型更大WhisperOpenAI 原版准确但慢、吃内存Faster Whisper适合显存 6GB 以上的 NVIDIA 卡快很多Whisper.cpp是 C 实现任意品牌 GPU 包括集显都能跑纯 CPU 也可以是 Mac 上的首选HuggingFace可加载自定义模型还支持 Meta MMS 等覆盖上千种语言的模型。硬件加速方面NVIDIA 卡走 CUDALinux 开箱可用Windows 需要 CUDA 12多数 GPU 可通过 Whisper.cpp 走 VulkanCPU 需支持 AVX2太老的机器跑不动。❓ 常见问题速查问模型存在哪里答Linux 在~/.cache/BuzzmacOS 在~/Library/Caches/BuzzWindows 在%USERPROFILE%\AppData\Local\Buzz\Buzz\Cache。问转录太慢怎么办答换更小的模型或改用 Whisper.cpp / Faster Whisper 后端显存 6GB 以上时 Faster Whisper 收益最大。问断网环境能用吗答可以。先在有网机器上下载好模型把模型文件夹拷到离线机器的相同位置即可。问麦克风报 PaErrorCode 错误答检查系统麦克风隐私权限例如 Windows 的设置 - 隐私 - 麦克风。问程序崩溃答常见原因是模型下载不完整重新下载模型日志入口在“帮助 - 关于 Buzz - 显示日志”。问英语模型转不了别的语言答名字带.en的模型只支持英语换成多语言模型即可。Buzz 把解码音频、模型推理、生成文字整条链路都放在你自己的硬件上录音和文稿默认不出机器。对于经常处理采访素材、内部会议录音的用户这份数据自主权比单次提速更实在。项目以 MIT 协议开源完整文档位于仓库内的 docs/docs/ 目录。【免费下载链接】buzzBuzz transcribes and translates audio offline on your personal computer. Powered by OpenAIs Whisper.项目地址: https://gitcode.com/GitHub_Trending/buz/buzz创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考