VideoSrt免费视频字幕工具:3分钟把视频语音自动转成SRT字幕,支持中英双语
【免费下载链接】video-srt-windows这是一个可以识别视频语音自动生成字幕SRT文件的开源 Windows-GUI 软件工具。项目地址: https://gitcode.com/gh_mirrors/vi/video-srt-windows
VideoSrt 是一款免费开源的 Windows 视频字幕工具,能把视频和音频里的语音自动识别成带时间轴的 SRT 字幕文件。它主打"原视频不出本机、只上传音频做识别",既保护素材隐私,又省下手动敲字幕的几小时。这篇文章就带你从零上手,3 分钟跑通第一条字幕。
😩 视频剪好了,字幕却把人折磨疯
你大概也经历过这样的夜晚:视频剪辑完、配乐调完,最后一步加字幕,结果发现一小时的内容要手动敲几百行字,敲到凌晨怀疑人生。
想找现成的工具吧,又有两难:在线工具要么要求上传整段视频,素材内容暴露在别人服务器上心里发慌;要么按分钟收费,视频一长钱包先抗议。字幕成了"剪视频最后一公里"的噩梦。
有没有一个工具,能听懂视频里的人话,自动把它变成字幕?有的——这就是VideoSrt。
🎯 一句话认识 VideoSrt:本地提取音频,云端精准转写
VideoSrt 是一个用 Go 语言开发的 Windows 开源 GUI 软件,核心能力一句话概括:识别视频和音频里的语音,自动生成带时间轴的字幕 SRT 文件。识别完还能顺手输出 LRC 歌词和纯文本,一次处理三个产物。
它凭什么好用?看这几点:
- 隐私友好:视频本体从不离开你的电脑。软件先用内置的 ffmpeg 在本地提取音频,只把提取出的音频文件交给阿里云"录音文件识别"接口去转写。素材画面、敏感内容全程不出本机。
- 识别准:标准普通话和英语的识别准确率在 95% 以上,应付纪录片、课程、采访这类清晰语音绰绰有余。
- 全自动流水线:提取音频 → 上传识别 → 生成字幕 → 可选翻译,一键触发,中途不用人工干预。
- 完全开源免费:软件本身无任何授权费,识别的核心引擎在
app/aliyun/目录,音视频处理逻辑在app/ffmpeg/目录,放心用、随便改。
一句话:它把"字幕"这件苦差事,变成了"点一下按钮"。
🧑🤝🧑 谁最需要它?对号入座看看有没有你
如果你是下面这几类人,VideoSrt 基本就是为你准备的:
- B站、抖音、视频号的内容创作者:每期视频都要配字幕提升完播率,以前占半天,现在批量拖进软件,几个视频一起出字幕。
- 网课老师、知识博主:想给课程加双语字幕,用 VideoSrt 生成中文台词后再走翻译,中英双语教学素材直接产出。
- 职场人:会议录音、培训录像、客户访谈,一键转成带时间戳的文字稿,整理会议纪要的速度快一倍。
- 播客主播、音频内容制作者:MP3、WAV 录音直接转成文稿,还能生成 LRC 歌词,同步发布到音乐平台。
- 外语学习者:把自己感兴趣的英文视频转成中英双语字幕,等于有了一个无限量的精听材料库。
⚡ 三分钟快速上手:从下载到出字幕
按下面四步走,第一次使用就能顺利出片。
第 1 步:下载安装,认准"含 ffmpeg"版本
在下载页面选带ffmpeg依赖的安装包。ffmpeg 负责从视频里提取音频,软件自带它就不用手动配置环境,对新手最省事。如果你习惯自己编译,也可以克隆源码来折腾:
git clone https://gitcode.com/gh_mirrors/vi/video-srt-windows
第 2 步:配置阿里云语音识别引擎
去阿里云开通"对象存储 OSS"和"录音文件识别"两个服务,拿到 AccessKey ID、AccessKey Secret,以及 OSS 的 Bucket 信息,填入软件的"语音识别引擎"设置页。这是整个流程里唯一需要动点脑筋的环节,按界面提示一步步填即可。
第 3 步:添加文件,勾选输出类型
把视频或音频直接拖进任务列表(支持多选批量添加),然后勾选想要的文件类型:SRT 字幕、LRC 歌词、TXT 纯文本,可以全选。再选择识别语言(中文、英文等),确认输出目录。
第 4 步:点击"开始识别",等待完成
界面下方的日志区会实时滚动处理进度。完成后,对应的字幕文件就出现在输出目录里,打开就是标准 SRT 格式,任何播放器和剪辑软件都能直接使用。
🔧 进阶玩法:这几个功能才是效率密码
基础流程跑通后,下面四个功能能帮你再省下大量时间。
批量多任务并发处理:一次拖入几十个文件,软件会按你设定的并发数同时处理。性能好的电脑把并发数调高,出片速度直接翻倍。多任务调度逻辑在app/task.go中实现,想看原理的可以去翻翻。
双语字幕一键输出:打开翻译开关,选好翻译引擎(百度翻译或腾讯云翻译)和目标语言,软件会自动生成"原文+译文"上下排列的双语字幕。做双语课程、双语视频,一个按钮全搞定。
过滤规则三件套:语气词过滤(自动删掉"嗯、啊、呃"这类口头禅)、自定义文本过滤(指定要屏蔽的词汇)、正则表达式过滤(按规则批量清理)。字幕会干净专业得多,尤其适合访谈、脱口秀这类口语化内容。
已有 SRT 的批量翻译与编码转换:它不只能从零生成字幕,还能把现成的 SRT 文件批量翻译、批量转编码(如 UTF-8 带 BOM,适配不同播放器和剪辑软件的兼容性要求)。老字幕素材也能二次利用。
📊 真实场景对照表:你的用法在这里
| 人群 | 常见任务 | 推荐用法 | 关键收获 |
|---|---|---|---|
| 自媒体创作者 | 每期视频加字幕 | 批量导入 + 语气词过滤 | 一期视频省下大半天 |
| 网课老师 | 课程双语字幕 | 中文识别 + 百度/腾讯翻译 | 中英双语素材一次产出 |
| 职场人 | 会议纪要整理 | 录音转 TXT 文稿 | 纪要整理速度快一倍 |
| 播客主播 | 节目文字稿和歌词 | 音频转 SRT + LRC 双输出 | 多平台一次分发 |
| 外语学习者 | 双语精听材料 | 英文识别 + 中文字幕输出 | 免费海量学习素材 |
| 字幕翻译人员 | 旧字幕批量处理 | SRT 批量翻译 + 编码转换 | 批量任务自动化 |
🕳️ 避坑指南:新手最常踩的 4 个坑
问题一:点击识别后一直报错或提示配置失败原因:阿里云服务未正确开通,或 AccessKey 权限不足、Region 填错。 解决:先确认 OSS 和"录音文件识别"两个服务都已开通,再核对 Key 是否复制完整,Region 要和 Bucket 所在区域保持一致。配置项可以参考app/aliyun/目录里的实现逐项对照。
问题二:删除或移动了软件目录下的data文件夹原因:data是软件的配置和缓存存储目录,被删后所有引擎配置、翻译设置全部丢失。 解决:养成习惯,data文件夹别动它。升级版本时,用旧版data文件夹覆盖新版同名文件夹,配置即可无缝迁移。
问题三:提示找不到 ffmpeg原因:下载的是"不含 ffmpeg 依赖"的精简包,而电脑上也没装 ffmpeg 环境。 解决:直接换"含 ffmpeg"的版本包重装,或者自行安装 ffmpeg 并把环境变量配好,一劳永逸。
问题四:担心用这个软件会不会产生费用原因:语音识别和翻译走的是阿里云、百度、腾讯云的 API,超出免费额度会收费。 解决:日常适量使用基本都在各平台免费额度内,不会产生费用;只有高频大量使用才建议按需购买资源包。软件本身永远是免费的。
🚀 现在就试试:让第一个视频拥有字幕
VideoSrt 把"字幕"从一件劝退新手的苦差事,变成了十分钟就能跑通的自动化流水线:本地提取音频保护隐私,阿里云精准转写保证质量,再叠加批量处理、双语翻译、过滤规则这些进阶能力,一个开源小工具几乎覆盖了字幕制作的全部场景。
现在就去下载一个含 ffmpeg 的版本,把你的第一个视频拖进去,点下"开始识别"。几分钟后看到字幕文件生成的那一刻,你会回来感谢自己——原来做字幕,真的可以这么轻松。
【免费下载链接】video-srt-windows这是一个可以识别视频语音自动生成字幕SRT文件的开源 Windows-GUI 软件工具。项目地址: https://gitcode.com/gh_mirrors/vi/video-srt-windows
创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考