v1.5.5 · 更新于:2026-09-10 09:01:10
开会时来不及记、听课时手写得慢、采访录音堆了一堆却没空整理,这些情况很多人都遇到过。语音合成助手把手机变成一支会写字的笔,对着它说话,文字就出来了。它用上了深度学习做语音识别,对普通话和几种常见方言都做过调校,周围吵一点或者语速快一点,识别结果也不会乱得太离谱。除去转写,它还准备了不同场景的记录模式、断网也能用的本地识别,以及转写完成后的多格式导出。

- 识别准头够用:引擎基于深度学习训练,普通话之外还覆盖了几种主流方言。
环境嘈杂、说话偏快的时候,出错的字比想象中少,改起来不费劲。
- 按场景换策略:软件里预置了会议、课堂、访谈等模式,切换之后识别方式会跟着变。
会议模式下会自动把不同说话人分开,整理成有结构的纪要。
课堂模式则偏向抓知识点,把重点内容标出来。
- 断网照样能转:没有网络时也能把语音变成文字,数据在手机本地处理,不往云端传。
涉及内部会议或者不方便外传的内容,用这个方式会踏实一些。
- 导出分享顺手:识别完可以存成 TXT、Word、PDF 等格式。
也能直接发到常用的聊天和办公软件里,从记录到分享不用来回折腾。
1、实时转写:响应速度在毫秒级,说话的同时文字就跟着往外冒。
面试、直播、会议这类需要当场看到内容的场合比较合适。
目前完全支持。
2、方言识别:粤语、四川话等主流方言都能认。
本地交流、采访记录时用得上。
属于部分支持,具体语种以软件内可选列表为准。
3、长文处理:几个小时的音频也能转,转完会自动分段。
讲座、课程、访谈这类内容量大的场景省事不少。
目前完全支持。
4、云端同步:换设备时数据可以接上,不用重新整理。
跨平台办公的人会用到。
需要登录账号后才能使用。
【麦克风权限别关】
长时间录制时,麦克风权限要保持开启。
权限被关掉,录音会中断,甚至根本起不来。
【防止后台被杀】
有些安卓机型会在后台清理进程。
把本应用加进电池优化白名单,或者允许自启动,录制中途就不容易被掐断。
【离声源近一点】
环境吵的时候,尽量靠近说话的人。
戴上耳机麦克风效果更好,背景噪音少了,识别准确率会明显上去。
【方言要提前选】
要处理方言,先在设置里挑好对应的方言模型。
用普通话模型去认方言,结果基本是错的。
【留够存储空间】
手机剩余空间建议大于 500MB。
长音频文件体积不小,空间不够可能存不下来。
导出 PDF 时如果缺少依赖组件,软件会提示下载,点确认装完就能用。
【闪退黑屏怎么办】
这类问题多半是系统版本偏低或者缓存冲突引起的。
先试着清一下应用缓存,或者重启手机。
还是不行的话,检查是不是兼容性问题。
【记得定期备份】
重要的记录定期备份到云端或者电脑。
手机丢了、坏了,数据不至于找不回来。
-- 免费能用吗:基础功能可以一直免费用。
包括每天一定时长的转写额度、几种导出格式以及离线识别。
日常记录够用了,只有超长音频转写或者高级云端同步才需要升级会员。
-- 数据安全吗:语音数据默认在本地处理,不上传服务器。
选择云端同步时走的是端到端加密,传输和存储都有保护。
软件经过正规应用商店审核,没有恶意扣费和弹窗广告。
-- 支持哪些语言:目前以普通话、粤语、四川话等中文方言为主。
英语、日语等部分外语也能识别。
语种范围会随版本更新慢慢扩大,最新列表可以留意官方公告。
-- 能导出 Word 吗:可以,识别结果能直接存成 Word、TXT、PDF 等通用格式。
需要继续编辑的文档选 Word,存档防改动选 PDF,只想快速看内容选 TXT。
v1.5.5 版本• 优化了语音识别引擎在嘈杂环境下的准确率
• 新增粤语
• 四川话等方言模型的切换入口
• 改进了长音频转写时的自动分段逻辑
• 修复了部分机型后台录制被中断的问题
• 调整了导出 PDF 时依赖组件的提示流程
• 修复了已知的界面显示问题
最新评论