如果你本地存有大量视频素材,比如Plex媒体库、家庭录像文件夹,很多视频缺少字幕,又不想把私人视频上传到云端转录,开源工具 Whisperer 是一个不错的选择。这款应用可以在本地电脑批量处理整个文件夹里的视频,一次性批量生成字幕文件,全程素材不会外传。
- GitHub:https://github.com/hclivess/whisperer
- 网盘:https://pan.quark.cn/s/49940f2b22c1
选取三类差异明显的视频做实测:语音清晰的NASA采访、音频老旧的档案纪录片《孟菲斯美女号》,还有自己录制的吉他手工演示视频,覆盖清晰人声、老旧低质音频、生活化个人录音场景,用来验证工具的实际表现。

核心亮点:本地运行+文件夹批量字幕
最关键的优势就是全部在本机完成运算,视频不会上传第三方服务器,很好保护家庭录像这类私人素材隐私。
操作流程简单:选定目标视频文件夹,软件自动生成任务队列,可预先调整转录引擎、识别语言、字幕输出格式,一键启动批量转录。
本次测试一共90分钟时长的三段视频,在测试PC上耗时约36分钟完成全部转录。处理过程可实时查看进度、预览文字识别结果。
输出结果是标准SRT字幕文件,并且自动适配Plex的命名规范。字幕文件和视频放在同一目录,Plex能够直接识别加载,无需手动重命名、转码视频。SRT属于通用字幕格式,VLC等绝大多数播放器都支持,一次生成,多播放器通用。
实测效果
字幕识别并非百分百完美,存在少量同音词识别错误,例如混淆 an 和 and。但这类偏差都属于微小瑕疵,不会影响阅读理解,不会扭曲原本对话含义。
作者认为对于家庭录像、老档案视频这类很难找到现成字幕的素材,这个准确度已经足够日常使用,不需要大量手动校对修正。
适用场景
- Plex、本地媒体库批量补全字幕
- 家庭私人录像、本地存档视频转录,重视隐私,拒绝上传云服务
- 批量纪录片、采访素材快速生成字幕初稿
局限
- 识别存在少量同音文字错误,专业影视级字幕仍需要人工校对;
- 转录速度高度依赖本机硬件配置,CPU/显卡性能会直接影响批量处理耗时。















0条评论