本项目是面向用电客户资料审核场景的 OCR 智能抽取与人工复核系统。系统基于 Flask、SQLAlchemy、MySQL、Jinja2 和 PaddleOCR 构建,支持 PDF 上传、页面拆分、OCR 识别、文档自动分类、逻辑文档合并、字段规则抽取、证据图片生成与审核纠错等完整流程。后台通过任务队列处理批量识别、重跑规则、签名回填等异步任务,并提供规则版本管理、OCR 缓存、限流重试和本地文件存储能力。项目提升了纸质/扫描资料的结构化处理效率,降低人工录入和审核成本,适用于电力业务资料归档、合同/表单审核和批量OCR 数据校验场景
一个面向本地大规模 PDF 教材库的轻量级浏览服务,基于 FastAPI + Uvicorn + PyMuPDF + pdf.js 实现。项目针对 83GB、2000 余本教材资源,提供目录树浏览、封面网格、书名即时过滤、SQLite FTS5 全文检索、PDF 在线阅读、阅读进度记 忆、收藏与深色模式等功能。针对教材库中大量 .pdf.N 分割文件,系统实现了虚拟拼接与 HTTP Range 流式读取,无需预合并即可透明打开大文件,降低磁盘占用并提升首屏加载体验。整体采用极简架构,一个后端服务配合静态前端即可运行,同时支持后台常驻与开机自启,适合作为个人知识库和局域网教材检索工具
本项目是面向用电客户资料审核场景的 OCR 智能抽取与人工复核系统。系统基于 Flask、SQLAlchemy、MySQL、Jinja2 和 PaddleOCR 构建,支持 PDF 上传、页面拆分、OCR 识别、文档自动分类、逻辑文档合并、字段规则抽取、证据图片生成与审核纠错等完整流程。后台通过任务队列处理批量识别、重跑规则、签名回填等异步任务,并提供规则版本管理、OCR 缓存、限流重试和本地文件存储能力。项目提升了纸质/扫描资料的结构化处理效率,降低人工录入和审核成本,适用于电力业务资料归档、合同/表单审核和批量OCR 数据校验场景...
一个面向本地大规模 PDF 教材库的轻量级浏览服务,基于 FastAPI + Uvicorn + PyMuPDF + pdf.js 实现。项目针对 83GB、2000 余本教材资源,提供目录树浏览、封面网格、书名即时过滤、SQLite FTS5 全文检索、PDF 在线阅读、阅读进度记 忆、收藏与深色模式等功能。针对教材库中大量 .pdf.N 分割文件,系统实现了虚拟拼接与 HTTP Range 流式读取,无需预合并即可透明打开大文件,降低磁盘占用并提升首屏加载体验。整体采用极简架构,一个后端服务配合静态前端即可运行,同时支持后台常驻与开机自启,适合作为个人知识库和局域网教材检索工具...
添加客服微信,免费为您安排与该工程师直接沟通
长按二维码添加客服微信
如该工程师当前档期不合,也可免费为您推荐相似候选人