语音转文字
把语音变成文字——上传音频文件或录制您的声音,选择语言,即可获得文字记录。您的音频绝不会离开您的设备。
0:00
如何使用 语音转文字
- 选择所说的语言,然后选择"上传"或"录制"。
- 上传音频文件,或直接用麦克风录制。
- 点击"转录",然后复制或下载文字。
关于 语音转文字
语音转文字可在您的浏览器中把语音音频转换为文字。上传录音——语音备忘录、访谈、讲座、会议——或直接用麦克风录制,选择所说的语言,即可获得可复制或下载的文字记录。它使用 WebAssembly 在您自己的设备上运行 Whisper 语音识别模型,因此您的音频绝不会被上传:私密、免费、无水印、无需注册。
在选择器中选对语言会让结果明显比自动检测更准确,尤其是较短的片段或带口音的语音——因此请在转录前设置好。首次使用时,您的浏览器会下载一次 AI 模型(约 75 MB)并缓存,之后运行会很快。由于处理是在您的设备上而非服务器上进行的,因此最适合几分钟以内的片段;很长的录音会更慢,且取决于您的电脑。背景噪音少、清晰的音频转录效果最好。
常见问题
我的音频会被上传到某处吗?
不会。语音识别完全在您的浏览器中通过 WebAssembly 运行。您的录音绝不会离开您的设备——只会下载一次 AI 模型。
支持哪些语言?
该模型是多语言的,可处理数十种语言。转录前请从选择器中选择所说的语言以获得最准确的结果;如果不确定,可保留"自动检测"。
为什么首次使用需要下载?
首次运行会下载语音识别模型(约 75 MB)并缓存在您的浏览器中,之后每次运行都会很快开始。
我可以使用什么音频,时长多久?
MP3、WAV、M4A、OGG 和 WebM 等常见格式都可以,还支持实时麦克风录制。最适合几分钟以内的片段——更长的录音也能用,但需要更多时间,因为一切都在您自己的设备上运行。

