扫描版 PDF 在手机上怎么读
明明屏幕上印着字,搜索却返回空、长按也选不中——多数时候不是应用出了故障,而是这份 PDF 里根本没有文字层。这篇讲清楚判断方法、ReadEra 能做到哪一步,以及把扫描件读舒服的几个开关。相关阅读:EPUB和PDF在手机上怎么打开.md · 安卓上看电子书的阅读器怎么选.md
对应的安卓阅读器是 ReadEra,功能清单与安装文件资源入口见 readera 介绍站,本篇只谈扫描件的读法。
一、三十秒判断:扫描件还是文件坏了
打开这份 PDF,做两个动作:
- 长按正文拖动选柄——能逐字选中并只高亮那一小段,说明有文字层;选区变成盖住整页的矩形、或弹不出选柄,这一页就是图片;
- 搜索一个肉眼可见的词——搜不到而第 1 步也选不中,基本可以确认是图片型扫描件。
两个动作都通过、只是偶尔个别页异常,才轮到怀疑文件损坏或下载不完整。
二、它没有 OCR,先把预期摆正
ReadEra 的功能列表里没有 OCR,不会把图片上的字识别成文字。对扫描件它提供的是「把纸面看清」的能力:
- 裁边:去掉扫描件四周的白边,正文放大铺满屏;
- 缩放与旋转:双指缩放,横倒的页面转正;
- 单列模式:跨页双页扫描拆成连续单页,省去来回放大;
- 目录跳转:文件自带目录书签时可以直接跳章。
相应地,全文搜索、选中复制、划线笔记、翻译查词这些依赖「选得中字」的功能,在图片型页面上都不可用——等多久也不会有结果,别把它当成卡顿或索引没建好。
三、要让搜索生效,得回到文件本身
唯一出路是用带 OCR 能力的 PDF 工具给文件加一层可搜索的文字,然后把新文件放进原来的目录,刷新书库再试。几点通行的经验:
- 扫描越清晰、越端正,识别准确率越高;歪斜发虚的底子神仙工具也救不全;
- 中英混排要把两种语言都选上,否则其中一种会大面积错字;
- 「有文字层但禁止复制」的文件是制作者设的限制,加 OCR 也没用;
- 整本识别费时,电脑上批量处理比手机上划算,手机端临时处理几页的文档更合适。
处理时保留原件,OCR 结果当副本用——识别稿未必全对,原件是核对依据。
四、读之前把页面调顺
按上面的开关把裁边、单列、缩放调到位,扫描版在手机上也能读得舒服;确认文件本身可搜索之后再投入做笔记,免得读到一半才发现划线用不了。书库里同时留着原件和 OCR 版时,把其中一份移出扫描范围就能只显示一条。