功能介绍
语音转文字工具基于浏览器内置的 Web Speech API,可将您的麦克风语音实时转换为文字。支持中文普通话、英语、粤语等多种语言,识别过程中实时显示中间结果(灰色)和最终结果(黑色),方便长文本录入。
使用方法
- 选择需要识别的语言(默认中文普通话)。
- 勾选「连续识别」可进行长文本不间断录音;不勾选则在一段话结束后自动停止。
- 点击「开始录音」按钮,在浏览器弹出的权限请求中选择「允许」麦克风访问。
- 开始说话,页面会实时显示识别文字。灰色为临时结果,黑色为已确认的最终结果。
- 点击「停止录音」结束识别,点击「复制文本」可将最终结果复制到剪贴板,点击「清空」重置内容。
技术原理
本工具使用 SpeechRecognition(Web Speech API)接口实现语音识别。浏览器采集麦克风音频后,将其发送至浏览器厂商的云端语音识别服务进行处理,再将识别结果以事件形式返回前端。中间结果(interimResults)是识别过程中的临时猜测,随着说话内容增加会不断修正,最终结果(isFinal)是确认后的稳定文本。
注意事项
- 推荐使用最新版 Chrome 或 Edge 浏览器,部分浏览器(如 Safari、Firefox)可能不支持或支持有限。
- 语音识别需要联网使用,且需授予麦克风权限。若误拒权限,可在地址栏左侧设置中重新开启。
- 识别准确率受环境噪音、麦克风质量、口音语速等因素影响,建议在安静环境下使用。
- 识别结果仅供参考,重要内容请人工核对。