读音规则与正则替换设置
让软件把文字念对,秘诀不在引擎,而在「朗读文本处理」这一层。本文整理 T2S 里读音相关规则的写法:预制开关怎么用、自定义替换规则怎么写、正则表达式在朗读场景的几个实用片段。想了解整体功能的,可以到 T2S 安卓朗读工具介绍 先过一遍。
一、先关掉那些"不该念"的
网页文章和带格式的文档直接朗读时,最常见的尴尬是引擎把网址、标点一个个念出来。T2S 内置了三个预制开关(在「朗读文本处理」里):
| 开关 | 作用 | 适用场景 |
|---|---|---|
| 不朗读网页链接 | 移除文本中的 URL | 朗读公众号、新闻网页 |
| 不朗读标点符号 | 避免念出波浪号、省略号 | 听小说、听聊天记录 |
| 不朗读 Wikipedia 中的引用 | 移除引用标记符号 | 听维基条目 |
三个开关全部打开,是大多数人的最优初始状态。
二、自定义替换规则的写法
预制开关管不到的,用「自定义规则」补。点右下角的创建按钮进入编辑器,填三样:
- 匹配文本:要被替换的原内容,支持正则表达式;
- 替换为:希望引擎实际念出的写法;
- 测试区:填一句话点「朗读」,当场验证效果再保存。
三、几个实用的正则片段
- 字母缩写拆开念:匹配
GPT替换为G-P-T,引擎就会逐字母念; - 生僻字转常用字:匹配
耄耋替换为冒蝶,读音直接纠正; - 去掉表格符号:匹配
\|或连续的-,替换为空,念表格文档不再一顿一顿; - 区分大小写:勾选后
IT与it分别处理,避免误伤普通英文单词。
四、规则生效的顺序
规则按列表顺序依次应用,上一条替换的结果会被下一条继续处理。所以「先去符号、再改读音」的顺序更稳——先把格式噪音清干净,再做针对发音的微调。