语音转文字工具

在线语音转文字,通过浏览器语音识别把麦克风语音实时转成文字,支持中文,可复制结果,识别在浏览器本地进行。

未开始
状态
0
最终字数
0
临时字数
点击「开始录音」按钮,授权麦克风权限后即可实时转文字。中间结果以灰色显示,最终确认结果以黑色显示。

功能介绍

语音转文字工具基于浏览器内置的 Web Speech API,可将您的麦克风语音实时转换为文字。支持中文普通话、英语、粤语等多种语言,识别过程中实时显示中间结果(灰色)和最终结果(黑色),方便长文本录入。

使用方法

技术原理

本工具使用 SpeechRecognition(Web Speech API)接口实现语音识别。浏览器采集麦克风音频后,将其发送至浏览器厂商的云端语音识别服务进行处理,再将识别结果以事件形式返回前端。中间结果(interimResults)是识别过程中的临时猜测,随着说话内容增加会不断修正,最终结果(isFinal)是确认后的稳定文本。

注意事项

为什么点击开始录音没有反应?

请先确认您使用的是 Chrome 或 Edge 浏览器,其他浏览器可能不支持 Web Speech API。其次检查是否允许了麦克风权限,可点击浏览器地址栏左侧的锁形图标查看权限设置。另外,部分浏览器要求页面必须在 HTTPS 环境下才能使用麦克风。

识别结果不准确怎么办?

可以尝试以下方法提升准确率:1)在安静环境下录音,减少背景噪音;2)使用质量较好的麦克风;3)语速适中、吐字清晰;4)选择正确的识别语言;5)避免距离麦克风过远或过近。

连续识别和非连续识别有什么区别?

连续识别模式下,识别会一直进行,直到您手动停止,适合长文本录入、会议记录等场景。非连续模式下,当您停止说话一段时间后,识别会自动结束,适合短句、命令式输入。

录音内容会被上传或保存吗?

语音数据由浏览器发送至其对应的云端识别服务(如 Google 或微软服务)进行处理,本工具本身不存储任何录音或识别文本。具体隐私政策请参考相应浏览器厂商的说明。敏感内容建议谨慎使用。