自动生成 SRT 字幕
选择音频或视频后,会生成带时间码的字幕文件(SRT)。如果是视频,可以在叠加字幕的状态下播放核对;导出前可以在页面上修改文字,可直接用于视频剪辑软件。
该语言在较小的模型上准确率会明显下降,请选择「Whisper Small」或更大的模型
如果已知说话人数,指定后准确率会大幅提升
生成字幕的使用方法
SRT 是使用最广泛的字幕格式,YouTube、Premiere Pro、DaVinci Resolve、VLC 都能直接读取。把导出的文件改成和视频相同的名称并放在同一文件夹,多数播放器会自动识别为字幕。
自动生成的字幕往往需要整理。专有名词的写法、标点位置、每行长度都可以在页面上修改,建议导出前先调整。使用替换功能可以一次性修正反复出现的识别错误。如果读取的是视频,可以在叠加字幕的状态下播放,确认可读性和时间是否合适。
常见问题
除了 SRT 还能导出别的格式吗?
还可以导出纯文本(TXT)。TXT 不含时间码,只有正文,适合用作会议记录或稿件。
可以按发言者区分字幕吗?
启用说话人分离后,每一行都会记录发言者。你也可以在页面上修改发言者名称,或逐行重新指定。
字幕时间轴出现偏移时能修正吗?
可以。点击行的时间,或在“⋮”菜单中选择“编辑时间”,就能按秒(精确到百分之一秒)重新输入开始和结束。还可以添加或删除行,因此可以在导出前补上模型漏掉的语句,或删掉静音段出现的错误行。
可以生成哪些语言的字幕?
可指定中文、日语、英语、韩语、西班牙语等 11 种语言,也可选择自动检测。内置模型为多语言版本,列表之外的语言在自动检测下通常也能识别。
准备音频、视频,以及转写之后
诚邀协助提升服务品质
无论成功还是失败,如果能把当时的情况发送给我们,都有助于查明原因(统计失败率需要两者兼有)。了解哪些设备、哪些设置更容易失败后,我们就能调整推荐设置并修复相应问题。如果方便,保持开启会帮上很大的忙。
会发送的信息
设备性能(GPU 型号、内存、核心数)、浏览器与操作系统、所选模型与语言、处理进行到哪一步、错误内容、文件格式和大致的大小与时长,以及处理耗时。
不会发送的信息
音频数据、转写结果、文件名和 IP 地址。数据只发送到本站自有服务器,不会交给第三方服务。