eSearch离线OCR识别竖排文字实操:两个开关一次框选,古籍照片也能转成通顺文本
【免费下载链接】eSearch截屏 离线OCR 搜索翻译 以图搜图 贴图 录屏 万向滚动截屏 屏幕翻译 Screenshot Offline OCR Search Translate Search for picture Paste the picture on the screen Screen recorder Omnidirectional scrolling screenshot Screen translator 支持Windows Linux macOS项目地址: https://gitcode.com/GitHub_Trending/es/eSearch
前阵子帮长辈整理家里的一页清代家谱照片,竖排繁体,密密麻麻。把它拖进常用的识别工具,出来的文字虽然能读,顺序却全乱了——本该从右往左、从上到下读的一列列字,被硬生生拼成了横排。后来换成 eSearch 离线OCR 重新识别,几分钟就拿到了通顺文本。这篇文章把整个过程完整记录下来:怎么安装、哪两个开关最关键、如何框选识别,以及识别之后怎么校对。照着一遍走下来,你就能独立完成一次竖排文字识别,遇到问题也知道去哪个设置里排查。
动手之前:把 eSearch 装进电脑
先简单认识一下它。eSearch 是一款免费开源软件,把截屏、离线OCR、搜索翻译、贴图、录屏都放在了同一个界面里。平时你大概只用得上其中一两样,但遇到竖排文字这种"偏门"需求,它内置的那套离线 OCR 引擎刚好能顶上。
这套引擎基于 PaddleOCR,模型直接装在本地,开箱即用。不联网、不注册、不收费,扫描件里的隐私内容也不会传到任何服务器。
安装方式按系统选一种即可:
Windows 用户,打开命令行输入:
winget install esearchArch 系 Linux 用户,在 AUR 里搜索e-search即可安装。
macOS 和其他发行版,去项目的发布页下载对应系统的安装包。
想从源码自己构建,依次执行:
git clone https://gitcode.com/GitHub_Trending/es/eSearch cd eSearch npm install装好后直接运行。此时 OCR 已经可用,不需要任何联网配置。
离线OCR设置的关键:两个开关决定竖排成败
我第一次用默认设置去识别那页家谱,结果很打击人:字都"认出来"了,但列和列的顺序是乱的,句子断得七零八落。问题不在软件不够聪明,而在两个默认开关上。
打开设置,找到"文字识别(OCR)"一栏,留意下面两个开关。
第一个是"整体方向识别",把它关掉。这个开关的描述原话是"识别整体方向并纠正,不适合竖排文字"。它的作用是检测整张图的文字方向并强行纠正,对横排是好事,遇到竖排反而会把阅读顺序搅乱。可以把它理解成一副固定度数的眼镜——度数配给了横排文字,戴到竖排上只会更晕。
第二个是"识别段落",保持开启。它在 OCR 段落识别里负责分析分栏与阅读顺序,让输出符合"从上到下、从右到左"的原版阅读习惯。家谱、古籍里常见的分栏和双行小注,靠的就是它。
顺带提一句:如果某些特殊版面在开启后段落顺序反而出错,可以试着关掉它做对比,效果以实际版面为准。
一次框选就出结果:Alt+C 的完整操作路径
设置调好之后,识别本身非常快:
按Alt+C(macOS 上是⌥C)进入框选模式。
鼠标拖出一个选区,把要识别的古籍区域圈起来。工具按钮会跟随选区自动移动,点击"文字识别"按钮即可;也可以在设置里把文字识别设为"框选后默认操作",这样框选完自动开始识别。
识别完成后,结果会和原图一起出现在编辑页:左侧是图片,右侧是文字。再读那页家谱,顺序就对了——从右往左,一列一列,段落结构也保留着。
第一次完整的竖排识别到这里就成功了,整个过程用不了一分钟。
自动删除换行:把断行拼回通顺的句子
识别出来的文字有时还带着换行:古籍版面的每列字会被拆成一个个短行,直接复制出去并不好读。这时用"自动删除换行"。
它会分析行尾标点,把多余的换行去掉;遇到拉丁文还会在单词之间自动补空格。你可以对整个文本执行,也可以选中部分文字单独处理。
那页家谱处理完换行之后,一整页内容就变成了一段段通顺的正文,可以直接存档。
图上选字、右侧同步:古籍文字识别后的校对
OCR 再准也难免看走眼,尤其是繁体字,字形相近很容易认错。eSearch 在编辑页提供了一套双向校对方式。
在左侧图片上点选文字,右侧编辑器会同步选中对应的内容;反过来,在编辑器里选中文字,左侧图片区也会自动定位到原文位置。相当于"图上指哪,编辑器就选哪",逐句核对非常直观。
编辑器自带拼写检查,疑似错误的地方会出现蓝色波浪线,一眼就能发现。比如"風"和"鳳"这类容易混的繁体字,哪里标了线,就回去核对哪里。
如果觉得某一段被段落识别处理得不满意,按撤回快捷键可以恢复到未识别段落前的原始排版,重新整理。
让重复劳动更省事:三个小开关和模型下载入口
识别竖排古籍常常是批量活,一次处理十几页甚至几十页,值得把几个省事选项打开:
- "框选后默认操作"设为文字识别,框完即识,少按一次回车。
- 开启"OCR后自动复制到剪贴板",识别完直接去文档里粘贴。
- 需要识别中文繁体、日文、韩文、拉丁文等语种时,到设置-OCR 页面下载对应离线模型。下载完自动加入模型列表,随时切换。德语这类欧洲语言对应拉丁文模型,页面上都有文字说明。
这几个开关都在设置里,打开一次,之后每一页都能省几秒,几十页下来就是好几分钟。
识别结果不对?按这张排查表逐步检查
实际操作中遇到问题,先别急着重装,按下面这张表从前往后查,大部分情况都是设置问题:
| 现象 | 检查项 | 解决办法 |
|---|---|---|
| 竖排被读成横排、顺序全乱 | "整体方向识别"是否开着 | 在 OCR 设置里关闭它 |
| 段落、列序混乱 | "识别段落"是否开启 | 确认已开启;仍乱则撤回恢复原始排版再试 |
| 繁体、日文识别结果差 | 当前用的是哪个模型 | 到设置里下载对应语言模型并切换 |
| 框选后找不到识别按钮 | 工具栏位置、默认操作 | 工具栏跟随选区移动;或将默认操作设为文字识别 |
| 识别准确率普遍偏低 | 图片质量 | 保证文字清晰、对比度足够,必要时旋转图片对齐方向 |
💡 竖排识别不理想时,第一个要看的就是"整体方向识别",这是最常见的原因。
竖排文字识别还能用在哪些地方
家谱只是其中一个例子,这套流程换个场景同样成立:
- 书法作品转录:把照片拍正、框选,竖排的行草内容也能转成文字存档。
- 竖排繁体 PDF 摘录:截图识别后经过双向校对,摘录质量往往比直接复制 PDF 原文还高。
- 日文、韩文竖排资料:切换对应语言模型即可。
- 民国报纸、老式招贴:分栏版面交给段落识别处理。
- 横排 PDF 的多余换行:同样可以用"自动删除换行"一键整理。
结尾:一张设置速查卡
把这一路用到的关键点收成一张卡,方便下次照着做:
- 快捷键
Alt+C进入框选。 - 设置 → 文字识别(OCR)→ 关闭"整体方向识别"。
- 确保"识别段落"开启。
- 可选:开启"自动删除换行"、"框选后自动OCR"、"OCR后自动复制"。
- 其他语言:设置 → OCR → 下载对应离线模型后切换。
- 校对:左侧图上选字,右侧编辑器同步定位。
✅ 更详细的设置说明在项目源码自带的docs/use/ocr.md和docs/use/start.md里,遇到文档没覆盖的情况,也可以去项目仓库反馈,一起把这款工具打磨得更好用。
【免费下载链接】eSearch截屏 离线OCR 搜索翻译 以图搜图 贴图 录屏 万向滚动截屏 屏幕翻译 Screenshot Offline OCR Search Translate Search for picture Paste the picture on the screen Screen recorder Omnidirectional scrolling screenshot Screen translator 支持Windows Linux macOS项目地址: https://gitcode.com/GitHub_Trending/es/eSearch
创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考