将 MP3 转为文字
选择 MP3 文件后,Whisper AI 会在浏览器内完成转写。音频不会发送到服务器。无需注册、无需付费,也没有时长限制。
正在检测你的运行环境…
该语言在较小的模型上准确率会明显下降,请选择「Whisper Small」或更大的模型
开启Beta
如果已知说话人数,指定后准确率会大幅提升
处理 MP3 时需要了解的事
MP3 是压缩格式,录制时的比特率会直接影响识别精度。128 kbps 以上的日常对话通常可以稳定识别;低于 64 kbps,或像电话录音那样高频被削减的音频,漏字会明显增多。效果不理想时,请把模型调到 small 或更大。
处理全部在本机完成。文件不会上传,转写结果也不会外传,因此会议录音、采访素材等不便外发的内容可以直接处理。
常见问题
除了 MP3 还支持哪些音频?
支持 WAV、M4A、AAC、FLAC、OGG、Opus、AIFF、WMA、AMR、WebM。选择视频文件时,只会提取音轨进行处理。
有文件大小限制吗?
单个文件最大 2 GB,手机端为 500 MB。没有时长限制,只要体积在上限之内,多长的录音都可以处理。
音频会被发送到什么地方吗?
不会。转写在本机浏览器内执行,音频文件和结果文本都不会传给外部服务器。
转写需要多长时间?
取决于设备性能和模型大小。在支持 WebGPU 的环境下往往快于实时;不支持时,可能需要音频时长的数倍。
准备音频、视频,以及转写之后
诚邀协助提升服务品质
无论成功还是失败,如果能把当时的情况发送给我们,都有助于查明原因(统计失败率需要两者兼有)。了解哪些设备、哪些设置更容易失败后,我们就能调整推荐设置并修复相应问题。如果方便,保持开启会帮上很大的忙。
会发送的信息
设备性能(GPU 型号、内存、核心数)、浏览器与操作系统、所选模型与语言、处理进行到哪一步、错误内容、文件格式和大致的大小与时长,以及处理耗时。
不会发送的信息
音频数据、转写结果、文件名和 IP 地址。数据只发送到本站自有服务器,不会交给第三方服务。