SubEdit 在线字幕编辑器:波形打轴与 AI 语音识别
做字幕的痛点从来不是「打字」,而是「对时间」。一集 45 分钟的视频,听一句、停一下、敲一行、调时间轴,一轮下来几个小时就没了。SubEdit 把这条流水线搬进浏览器:视频本地加载秒开、音轨画成波形用鼠标拖时间、AI 听写直接生成带轴字幕、AI 翻译一键多语种——全程视频文件不上传服务器。本文按工作流顺序讲用法。
打开就是工作台
打开 SubEdit 不需要注册登录,首屏即完整工具台:顶部工具栏按工作流排布——导入视频、AI 功能、导入字幕、翻译字幕、导出字幕、预览,配合撤销/重做与逐行操作。
图 1:SubEdit 工作台——工具栏即工作流
支持八种界面语言(中/英/日/韩/俄/法/印地等),右上角即点即切。
第一步:视频本地加载,秒开
点「导入视频」或直接拖入文件——视频在浏览器本地解析,不上传服务器、不占带宽、不占存储。这条原则贯穿整个工具:你的素材永远在自己手里。加载后即可播放预览,波形与字幕时间轴随媒体就绪。
第二步:字幕从哪来——三条路
路线 A:已有字幕文件,导入精修
支持 SRT/VTT/JSON 导入,直接进入表格编辑:每行字幕的序号、开始时间、结束时间、时长、文本一目了然,双击即改。
图 2:导入 SRT 后的编辑视图——逐行时间轴与文本
路线 B:AI 语音识别,一键生成
「AI 功能」提供语音识别:提取视频音轨,识别结果自带时间轴——从「听写+打轴」两步并成一步。识别由后端 AI 服务完成(阿里云百炼 DashScope 等,可自行部署),45 分钟的视频几分钟出稿,再人工过一遍专有名词即可。
路线 C:手动打轴,波形可视化
没有现成字幕也不想用 AI?波形视图把音轨画成可视化图谱,对着波形拖时间轴比对着播放器掐表快得多——语音的起止在波形上一目了然。整体偏移(字幕普遍快/慢半秒)用「全部前移/全部后移」一键解决。
第三步:翻译与校对
「翻译字幕」接入 AI 翻译服务,中英日韩等多语种互译,译文可另存一轨。校对环节配合波形与播放预览:点某行跳到对应时刻,边听边改;预览播放器内置字幕样式设置——字号、颜色、描边、背景、位置即调即看,所见即最终观感。
图 3:预览播放器的字幕样式设置——字号、颜色、描边、背景、位置实时预览
第四步:导出
SRT/VTT/JSON 多格式导出,直接用于:
部署形态:前端独立,AI 可选
SubEdit 是前端优先的架构:
- 基础编辑(导入、波形、打轴、导出)零后端,纯浏览器运行——这是它敢承诺「不上传」的技术底气;
- AI 能力(语音识别、翻译)需要配套的后端服务,协议开放、上游模型可自选,团队可完全自托管——数据不出内网。
个人用户用公开部署即可;机构用户自托管前端+后端,即得到一套私有的字幕生产线。