ARTICLE DETAIL

资讯详情

深耕网站建设、视觉设计与SEO优化的一线实战洞察。

基于深度学习的图片文字识别-python

基于深度学习的图片文字识别-python 本项目为前几天收费帮学妹做的一个项目在工作环境中基本使用不到但是很多学校把这个当作编程入门的项目来做故分享出本项目供初学者参考。一、项目描述基于深度学习的图片文字识别基于深度学习的 OCR 识别 Web 服务。用户在浏览器上传图片服务端调用识别引擎提取文字返回按行展示的识别结果与叠加效果图。浏览器访问 http://127.0.0.1:8880/二、项目功能网页图片上传支持点击选择通用图片 OCR识别图片中所有可见文字按行展示文本与置信度生成识别结果叠加图识别框 文字标注便于人工校对结果表格行点击复制一键复制全部识别文本提供 JSON 接口请求头 Accept 含 application/json 即返回结构化数据便于二次集成配套命令行工具身份证识别、身份证分割、训练集生成、验证码识别位于 bin 目录三、运行环境操作系统Windows 10Python 3.13D:\anaconda3 基础环境必须设置环境变量 PYTHONPATH 指向项目 python 子目录否则 deep_ocr 包无法导入启动命令在项目根目录执行 python deep_idocr.py默认监听 0.0.0.0:8880浏览器访问 http://127.0.0.1:8880/四、项目技术Web 框架Flask 3.x图像处理OpenCVopencv-contrib-python 4.8、Pillow、NumPy通用 OCRPaddleOCR 3.x基于 paddlepaddle 3.2.0字符分类ONNXRuntime身份证模式所用当前页面已停用几何与数据工具pyclipper、shapely、lmdb、imgaug、tqdm前端原生 HTML/CSS/JS无前端框架图片以 data URI 或静态路由加载以上系统源码经过技术整理与调试确保能正常运行五、项目截图
返回列表