将 MP4 视频转为文字
选择视频文件后,只会提取其音轨进行转写。视频本身不会被上传。结果会在播放视频时作为字幕叠加显示,也可以导出为 SRT 字幕。
该语言在较小的模型上准确率会明显下降,请选择「Whisper Small」或更大的模型
如果已知说话人数,指定后准确率会大幅提升
视频转写的处理方式
由于只提取音频,分辨率和视频编码不会影响结果。没有音轨的视频无法处理。背景音乐或环境噪音较大时精度会下降,这类素材建议使用 small 以上的模型,或事先调整音量。
转写完成后,播放视频时结果会作为字幕叠加在画面上。可以边看边修改文字,使用翻译功能后还能切换为译文字幕观看。支持导出为纯文本(TXT)和字幕(SRT)。SRT 带有时间码,可直接导入视频剪辑软件或 YouTube。启用说话人分离后,每一行还会记录发言者。
常见问题
支持哪些视频格式?
支持 MP4、MOV、MKV、WebM、AVI、WMV、FLV、MPEG-TS、3GP。所有格式都只提取音轨进行转写。
视频文件真的不会上传吗?
是的。读取视频和提取音频都在浏览器内完成,文件不会离开你的设备。
可以当作字幕文件使用吗?
可以。导出为 SRT 后就是带时间码的字幕,可直接导入剪辑软件或作为 YouTube 字幕使用。导出前可以播放视频,在页面上确认字幕内容和时间是否合适,并修改文字。
长视频也能处理吗?
只要文件在 2 GB(手机端 500 MB)以内,就没有时长限制。但处理过程中需要保持标签页打开。
准备音频、视频,以及转写之后
诚邀协助提升服务品质
无论成功还是失败,如果能把当时的情况发送给我们,都有助于查明原因(统计失败率需要两者兼有)。了解哪些设备、哪些设置更容易失败后,我们就能调整推荐设置并修复相应问题。如果方便,保持开启会帮上很大的忙。
会发送的信息
设备性能(GPU 型号、内存、核心数)、浏览器与操作系统、所选模型与语言、处理进行到哪一步、错误内容、文件格式和大致的大小与时长,以及处理耗时。
不会发送的信息
音频数据、转写结果、文件名和 IP 地址。数据只发送到本站自有服务器,不会交给第三方服务。