Buzz:离线语音转文字,隐私不出门的免费方案
【免费下载链接】buzzBuzz transcribes and translates audio offline on your personal computer. Powered by OpenAI's Whisper.项目地址: https://gitcode.com/GitHub_Trending/buz/buzz
你有没有遇到过这种情况:一段重要会议录音想转成文字,传到云盘又怕内容泄露?Buzz把 OpenAI 的Whisper语音识别模型整个搬到你本地,录音文件不用上传任何服务器,转录、翻译都在你自己电脑上完成。
一分钟搞懂 Buzz 离线语音转文字
Buzz 是一款开源的离线语音转文字工具:你导入音频或视频,它把语音变成文字,还能顺手翻译成英文。底层跑的是 OpenAI 开源的 Whisper 模型,转录全程不需要联网。它替你解决两个麻烦——录音内容不想上传云端,或者手头没有稳定网络。和云端转写服务最大的不同,是所有计算都发生在你的设备上,数据从头到尾不出门。可以这么理解:一套云端语音转文字服务,原样装进了你自己的电脑,免费,断网照用。
三步完成首次语音转文字
- 获取软件:从官方发布页下载对应系统的安装包(Windows 是安装程序,Mac 是 .dmg 直接拖进 Applications,Linux 装 flatpak 或 snap 包)。
- 基本配置:首次运行选 Whisper 模型和音频语言,默认 tiny 档体积小、出结果快,模型会自动下载到本地,之后离线也能用。
- 出第一个结果:点左上角"+"导入音频或视频文件(MP3、WAV、MP4 都支持),点运行;完成后双击该行,文字稿和时间轴直接可见,一键导出。
整个过程不用注册账号,也不用配置任何密钥,模型下完就能断网用。习惯命令行的话,Python 3.12 环境里两行搞定:
pip install buzz-captions python -m buzzBuzz 能力全景:这些活它都能干
Buzz 能干的活比你想的多,归成 4 个维度,对号入座看看你用得上哪块:
处理范围
- 音频、视频文件与 YouTube 链接
- 麦克风实时转录,边说边出字
- 99 种语言识别与翻译
文件导入、麦克风、多语言,三种输入渠道覆盖绝大多数日常素材。
精度与速度
- 5 个模型档位:tiny 到 large
- GPU 加速:N 卡 / Mac / Vulkan
- 语音分离先去噪再转录
机器性能不同,模型档位不同,按需切换,不折腾。
输出形式
- 导出 TXT、SRT、VTT 三种格式
- 说话人识别,区分多人对话
- 字幕长度自动合并与切分
做字幕的拿到 SRT,写纪要的拿到 TXT,各取所需。
自动化
- 文件夹监视,新文件自动转录
- 命令行批量处理
- 插件:AI 摘要、自动整字幕
重复劳动交给它,你只管听和检查。
实战场景:三个最有代表性的用法
🎯 挑一个和你最像的场景,对着做就行。
会议录音速记
导入会议录音,选好语言跑转录,导出 TXT 直接进你的笔记。
小技巧:语言手动选定,别用自动检测;专有名词再写进初始提示词,准确率立竿见影。
视频加字幕
导入 MP4 会自动提取音轨转录,再用调整功能按间隙合并、按标点切分,导出 SRT 直接拖进剪辑软件。
小技巧:单条字幕控制在两行以内,观众读起来不费劲。
外语内容翻译
任务类型选"翻译",外语音频统一转成英文文字稿,99 种语言输入都支持。
小技巧:初始提示词里附上人名、术语,专名不再被音译成一串奇怪字母。
进阶技巧:让转录更快更准
⚡ 这几条对新手最值钱:
- 开 GPU 加速→ N 卡走 CUDA、Mac 走 Apple Silicon、其他显卡走 Vulkan,大文件从半小时压到几分钟。
- 按重要性挑模型档位→ 粗筛听大意用 tiny/base,要交付的稿子用 large。
- 手动指定语言→ 跳过自动检测,又快一点又准一点。
- 开语音分离→ 嘈杂环境的录音先提取人声再转录,错误明显变少。
- 初始提示词塞术语→ 人名、产品名、领域词写进去,专名不再识别串。
- 配导出命名模板→ 文件名自动带上来源、日期等变量,批量导出不用手改。
常见问题快速排障
- 转录特别慢→ 换 tiny 或 base 档小模型,并确认 GPU 加速已开启
- 专名识别成错字→ 把人名、术语写进初始提示词,重跑一遍
- 小语种准确率一般→ 手动选具体语言,模型档位不低于 small
- Windows 安装时弹警告→ 应用未签名,选"更多信息"→"仍要运行"即可
从这段录音开始
回到开头那个场景:录音不想出门,文字又要马上拿到。Buzz 的解法就是把转录整个搬回本地,文件、麦克风、翻译一条线搞定。下一步很简单:装好它,丢进一段最近的会议录音,挑 small 档跑一遍——准确率够就直接用,不够再换 large。
【免费下载链接】buzzBuzz transcribes and translates audio offline on your personal computer. Powered by OpenAI's Whisper.项目地址: https://gitcode.com/GitHub_Trending/buz/buzz
创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考