实时离线语音识别 0 字
💡 100% 本地离线识别,文字实时秒级上屏。录音结束后可试听与导出您本人的真实原声 (192k MP3)
状态:就绪,点击麦克风开始
离线神经文字朗读 离线合成
状态:就绪
共 0 条记录
📂

暂无录音历史,去录制一段或导入音频吧

📖 软件使用说明

WASM 纯离线版
🌟 Web 离线技术与架构特点
  • • 纯前端 WASM 引擎:基于新一代 Kaldi / sherpa-onnx 官方 WebAssembly 离线推理内核,无需安装任何客户端或插件,浏览器打开即用。
  • • 31MB 轻量级中文模型:搭载针对移动浏览器深度优化的 Zipformer 中文 INT8 模型,首次下载后永久缓存在设备中,断网、无信号或飞行模式均可秒级出字。
  • • 100% 隐私安全:语音识别计算全部在您手机或电脑本地芯片完成,绝不向任何云端服务器上传音频或文本,彻底杜绝隐私泄露。
🎙️ 核心功能一览
  • • 实时语音听写 (STT):点击麦克风边说边出字,文字毫秒级实时流式上屏,同时无损采集您本人的真实原声。
  • • 录音即时试听与导出:录音结束后原地生成回放条,可直接试听并一键导出 192kbps 高清 MP3 音频文件。
  • • 外部音频导入转写:支持选择手机或电脑中的本地音频文件(MP3/WAV/M4A/AAC 等),纯离线高速转写出字。
  • • 语音朗读 (TTS):输入文字本地朗读,预置标准女声音色,支持 0.5x~2.0x 语速微调及一键导出 MP3。
  • • 本地录音历史库:基于浏览器内置 IndexedDB 数据库离线存储,支持回放、添加便签备注、一键复制与全部清空。
📱 Web 版与安卓 APK 版定位说明
  • • Web 网页版(当前版本):免安装、跨平台通用(安卓 / 苹果 / 电脑浏览器均可访问),采用 31MB 轻量级中文模型,秒开省流量,主打日常中文高效记录。
  • • 安卓原生 APK 版:预打包约 236MB 中英双语 Paraformer 大模型,适合高频中英混杂专业场景。两个版本架构独立、互不干扰,可按需搭配使用。
💾 导出格式与音频参数
  • • 真实录音格式:标准 MP3(16kHz 单声道采样,192kbps 高清比特率),音质清晰且文件轻巧,全平台兼容。
  • • 保存位置:一键导出后自动保存至手机或电脑本地的「下载 (Downloads)」目录,方便微信、QQ 或邮件随时发送分享。