3 步跑通 RapidOCR:古籍竖排文字 OCR 的完整实战记录
3 步跑通 RapidOCR古籍竖排文字 OCR 的完整实战记录【免费下载链接】RapidOCR Awesome OCR multiple programing languages toolkits based on ONNX Runtime, OpenVINO, MNN, PaddlePaddle, TensorRT and PyTorch.项目地址: https://gitcode.com/GitHub_Trending/ra/RapidOCR刚到手一摞线装书纸色发黄、文字竖排从右往左、繁体与异体字混着走。喂给传统 OCR 工具第一行输出就是空的或者把一行字拦腰截成两段——横排工具在竖排面前基本报废。古籍数字化场景里这是最常见的卡点。RapidOCR 是一个开源免费的 OCR 库正好把这个卡点跑通。两句话读明白 RapidOCR 的定位RapidOCR 是基于 PaddleOCR 模型权重、由 ONNX Runtime / OpenVINO / MNN / PaddlePaddle / TensorRT / PyTorch 做推理的轻量多平台 OCR 工具包不用装完整的 PaddlePaddle 全家桶。对古籍数字化它解决的核心问题是把竖排文字、繁体字、中日韩混排这类横排工具看不下去的页面变成带坐标框、文本和置信度的结构化结果。竖排文字背后的 3 个机制检测加自动旋转竖排行如何变可读python/rapidocr/utils/process_img.py 里有一处逻辑对古籍很关键文本行裁切后如果裁剪图高宽比 ≥ 1.5会自动旋转 90° 再送入识别模型。也就是说竖排行在裁出的瞬间被转正识别模型按横排处理不需要单独学竖排模式。多语言开关繁体、日文各有专门模型Rec.lang_type可以在中文默认模型和chinese_cht繁体、japan日文、korean韩文等之间切换。一个参数换掉整套识别模型和字典古籍里夹杂的日文、繁体页面都能直接覆盖。检测、分类、识别三步可独立开关管线是检测找文本行框→ 方向分类0°/180°→ 识别每一步都能用use_det/use_cls/use_rec单独关掉。只要框不要文字时省掉识别能省掉一大截耗时。三步跑出第一份识别结果 先装pip install rapidocr onnxruntime然后四行代码from rapidocr import RapidOCR engine RapidOCR() print(engine(shuji_sample.jpg).txts)首次运行会自动把检测、分类、识别三个模型下载到本地 models 目录之后就能离线跑。输出是文本行、行框、置信度三组对齐的数据能直接进数据库或校对表。竖排古籍整页走一遍完整链路输入一页线装书扫描件竖排、从右向左纸张有轻微污渍。关键配置默认值先别动box_thresh0.5、text_score0.5调用时加return_word_boxTrue打开词级框方便检查行切分是否干净。输出一组文本行加各自坐标框。行的先后按模型输出顺序给需要从右到左读时按框的水平中心坐标排一遍序即可不用等它自己保证顺序。一个注意点整页扫描字小时别把图缩得太狠笔画在降采样后糊掉识别模型也救不回来。宁可保持原始分辨率让检测模型自己按limit_side_len缩放。繁体日文混排页面怎么切换模型输入一页繁体中文夹日文汉字比如译注本古籍。关键配置engine RapidOCR(params{Rec.lang_type: japan})再按需调Rec.model_typemobile/server和Rec.ocr_version。输出单一语言页面用对应语言模型通常比通用中文模型更准。真混排的页面建议先用中文模型全量跑一遍把低置信度的行挑出来再用日文模型复跑替换。踩过的 3 个坑和绕法坑一扫描件方向不对手机拍古籍会带 EXIF 方向标记肉眼看着正、像素可能歪着。RapidOCR 读图时按 EXIF 自动修正方向同一个文件换到别的工具可能结果完全不同。交付前拿一张带方向标记的样图验证一下链路才算稳。坑二老化背景出误检框纸面污渍、霉点被检成文字。先把box_thresh调高比如 0.5 → 0.6 以上压误检如果压掉误检后发现淡字、残字漏检再微调unclip_ratio让框的外扩收敛一点。这两个旋钮方向相反小步调别一次拉满。坑三首跑下载模型和 CPU 速度首次运行要拉检测、分类、识别三套模型离线机器会卡住。可以把模型文件预先放到model_root_dir指定的目录再初始化。CPU 上嫌慢就把model_type降到tiny/mobile换速度server版留给精校环节。能做什么、不能做什么下一步怎么走RapidOCR 能做较干净古籍扫描件竖排为主含繁体和常见中日韩混排的文本行检测、识别与置信度输出。做不了古文字、异体字识别不是它的主场没有专门古文字模型栏区切分、横竖混排版面分析、文本对齐也要自己处理。下一步动作拿你自己古籍的 3-5 页样本先默认配置跑一遍把置信度低于 0.7 的行整理成复核清单再对着清单调text_score和box_thresh——这是把识别准确率提上去最快的路径。全部参数含义可查 python/rapidocr/config.yaml。【免费下载链接】RapidOCR Awesome OCR multiple programing languages toolkits based on ONNX Runtime, OpenVINO, MNN, PaddlePaddle, TensorRT and PyTorch.项目地址: https://gitcode.com/GitHub_Trending/ra/RapidOCR创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考

相关新闻

2025年AI眼镜深度拆解:光学方案、端侧算力与市场格局

2025年AI眼镜深度拆解:光学方案、端侧算力与市场格局

简介:《2025年中国AI眼镜行业研究报告》聚焦AI眼镜赛道,面向研发、投资与营销人士,系统梳理行业现状、技术进展与市场前景,并厘清AI眼镜与AR/VR/MR的边界,以及多模态交互、计算机视觉、语音识别等关键概念。报告按技术…

2026/9/20 15:14:32 阅读更多 →
离线环境下的软件交付工程实战:从容器打包到冷启动部署

离线环境下的软件交付工程实战:从容器打包到冷启动部署

/* MD / 富文本中的 .toc(含博客园搬家等嵌套结构);.toc-box 在侧栏,不受影响 */#content_views .toc,/* 编辑器常在目录前后插入空 p(:empty 仍占 20px),一并去掉避免顶空隙 */#content_views.markdown_views > p:empty:has(+ .toc),#content_views.markdown_views …

2026/9/20 15:14:32 阅读更多 →
用 Gatsby 主题 Shadowing 创建并使用自定义 Docz 主题:完整实战指南

用 Gatsby 主题 Shadowing 创建并使用自定义 Docz 主题:完整实战指南

文档静态站点开发工具 【免费下载链接】docz ✍ It has never been so easy to document your things! 项目地址: https://gitcode.com/gh_mirrors/do/docz 点击查看 免费下载 Docz 本身基于 Gatsby 构建,因此它的主题系统直接复用了 Gatsby 的 Theme S…

2026/9/20 15:13:32 阅读更多 →

最新新闻

3个步骤搞定非同类环境,性能优化不再卡半天

3个步骤搞定非同类环境,性能优化不再卡半天

3个步骤搞定非同类环境,性能优化不再卡半天 配置环境就卡半天,是大多数开发者入行或切换技术栈时的噩梦。明明照着教程敲代码,依赖装了一半报错,版本冲突让人头大,最后只能放弃,觉得这技术“不适合我”。其实,90%的卡顿源于对 非同类…

2026/9/22 0:34:04 阅读更多 →
关爱男性健康新手避坑:3步搞定Python性能瓶颈

关爱男性健康新手避坑:3步搞定Python性能瓶颈

关爱男性健康新手避坑:3步搞定Python性能瓶颈 官方文档翻了三遍还是没搞懂为什么代码这么慢?别慌,这不是你的错。 很多新手在写Python时,总觉得逻辑通了就行,结果一上线数据量稍微大点,CPU直接飙红。 这就是典型的 新手避坑…

2026/9/22 0:34:04 阅读更多 →
2026最新怎么快速长头发全栈实战指南

2026最新怎么快速长头发全栈实战指南

2026最新怎么快速长头发全栈实战指南 刚接手新项目,从 GitHub 或同事电脑里拷来一段代码,运行直接报错 ModuleNotFoundError 或者 SyntaxError…

2026/9/22 0:34:04 阅读更多 →
社会主义核心价值版本升级后API全变了新手避坑指南

社会主义核心价值版本升级后API全变了新手避坑指南

社会主义核心价值版本升级后API全变了新手避坑指南 版本升级后 API 全变了,新手避坑最头疼。 刚拿到新项目,发现旧代码跑不通。 文档还是旧的,报错全是红的。 别慌,这种“社会主义核心价值”在工程界的映射,其实就是…

2026/9/22 0:34:04 阅读更多 →
se播3个避坑点与完整示例

se播3个避坑点与完整示例

se播3个避坑点与完整示例 官方文档翻了三遍,还是不知道哪里该改?别慌,这不是你的问题,是资料太散。很多人卡在“se播”这个概念上,其实它核心就两点: 数据同步的稳定性 和 业务逻辑的解耦 。今天不整虚的,直接上干货,给你看几套在…

2026/9/22 0:34:04 阅读更多 →
3步搞定Piranha源码解析,版本升级API全变不再慌

3步搞定Piranha源码解析,版本升级API全变不再慌

3步搞定Piranha源码解析,版本升级API全变不再慌 刚把项目从 Piranha 1.x 升到 2.x,启动直接报错。打开文档一看,API 全变了。以前用的 Site.Create…

2026/9/22 0:33:04 阅读更多 →

日新闻

3台商务办公笔记本实测:手写实现环境配置,告别卡半天

3台商务办公笔记本实测:手写实现环境配置,告别卡半天

3台商务办公笔记本实测:手写实现环境配置,告别卡半天 配置环境就卡半天?别怪机器慢,多半是你没选对工具链。在Java、Go或Python的项目现场, 手写实现…

2026/9/22 0:00:41 阅读更多 →
剑帝加点速查手册:3分钟搞懂核心逻辑

剑帝加点速查手册:3分钟搞懂核心逻辑

剑帝加点速查手册:3分钟搞懂核心逻辑 面试被问原理答不上来,是不是常态?别慌。很多开发者对着 GitHub 开源仓库里的代码发呆,看似简单实则暗藏玄机。今天这份【剑帝加点】速查手册,直接带你拆解核心实现,把面试必考的原理讲透。…

2026/9/22 0:00:41 阅读更多 →
手写实现图片压缩网站核心:搞定WebP转换与质量调优

手写实现图片压缩网站核心:搞定WebP转换与质量调优

手写实现图片压缩网站核心:搞定WebP转换与质量调优 复制来的代码跑不通不知道怎么调?别慌,这种“复制粘贴地狱”在开发圈太常见了。尤其是做 图片压缩网站…

2026/9/22 0:00:41 阅读更多 →

周新闻

Flutter for OpenHarmony游戏卡片渐变背景实战:从原理到性能优化

Flutter for OpenHarmony游戏卡片渐变背景实战:从原理到性能优化

直接铺开项目本身吧。这几个月我一直在折腾一件事:用Flutter给OpenHarmony做一款游戏集合类的App,说白了就是把若干小游戏塞进一个壳里,用统一入口分发。这个方向本身不算新鲜,真正让我花了不少心思的,是首页那堆游戏卡…

2026/9/21 3:13:20 阅读更多 →
Word表格编号全攻略:从列表编号到题注交叉引用

Word表格编号全攻略:从列表编号到题注交叉引用

写Word文档,最让人头疼的往往是那些“看起来不起眼”的小问题。比如表格编号这事:今天在表后面多加了两个空白行,明天给客户交稿前发现整个章节的编号全部错位,光是挨个改序号就能耗掉大半个下午。我前阵子帮人整理一份上百页的技…

2026/9/21 2:19:36 阅读更多 →
从第一个站到第二个站:独立开发者的静态网站选型与落地实践

从第一个站到第二个站:独立开发者的静态网站选型与落地实践

1. 项目概述1.1 核心需求解析做独立开发者这几年,说实话,第一个网站上线的那天晚上我兴奋得没睡着。但等它跑了半年,流量惨淡、功能臃肿、代码自己都懒得看第二遍之后,我才慢慢琢磨明白一个道理:第一个网站是练手&…

2026/9/21 4:51:05 阅读更多 →

月新闻

持续集成 流水线自动化与 声明式交付 实践:原型怎样变成可用功能

持续集成 流水线自动化与 声明式交付 实践:原型怎样变成可用功能

持续集成 流水线自动化与 声明式交付 实践:原型怎样变成可用功能分类:[AI/大模型]细分主题:AI 增强型 CI/CD 流水线自动化与 GitOps 实践:Agent 工作流、工具调用与任务拆解:从原型到生产的验收清单很多团队在尝试用大…

2026/9/21 15:36:51 阅读更多 →
容器编排 生产环境运维与排障实战:复盘记录怎样真正派上用场

容器编排 生产环境运维与排障实战:复盘记录怎样真正派上用场

容器编排 生产环境运维与排障实战:复盘记录怎样真正派上用场分类:[工程技术]细分主题:Kubernetes 生产环境运维与排障实战:可复制的项目复盘模板与决策记录大部分团队的事故复盘报告,最后都变成了躺在 Confluence 或钉…

2026/9/21 15:36:51 阅读更多 →
容器 容器化技术与镜像安全管理:核心链路应该先拆哪一步

容器 容器化技术与镜像安全管理:核心链路应该先拆哪一步

容器 容器化技术与镜像安全管理:核心链路应该先拆哪一步分类:[工程技术]细分主题:Docker 容器化技术与镜像安全管理:核心链路的逐步实现与关键代码取舍面对一个积累了五六年历史包袱的单体架构应用(包含 Web 接口、后台…

2026/9/19 23:35:34 阅读更多 →