umi-ocr识别文件夹所有文件并导入数据库

2024-04-05 21:28

本文主要是介绍umi-ocr识别文件夹所有文件并导入数据库,希望对大家解决编程问题提供一定的参考价值,需要的开发者们随着小编来一起学习吧!

最近有个需求是识别身份证所有信息。所以调用umi-ocr接口并写入mysql

import os
import glob
from time import sleep
import requests
import json
import pymysql
import tkinter as tk
from tkinter import ttkfrom sympy import truedef write_to_database(image_path, response_text, db_config):with pymysql.connect(**db_config) as conn:with conn.cursor() as cursor:sql = "INSERT INTO image_records (path, text) VALUES (%s, %s)"cursor.execute(sql, (image_path, response_text))conn.commit()def get_image_paths(directory, extensions=['.jpg', '.png']):image_paths = []for ext in extensions:pattern = os.path.join(directory, f'*{ext}')image_paths.extend(glob.glob(pattern))return image_pathsdef send_http_post_request(url, data, headers=None, auth=None):default_headers = {'Content-Type': 'application/json'}if headers is not None:headers = {**default_headers, **headers}else:headers = default_headersjson_data = json.dumps(data)response = requests.post(url, data=json_data, headers=headers, auth=auth)return responsedef returndata(directory, db_config):# 使用os.walk遍历目录for root, dirs, files in os.walk(directory):for filename in files:sleep(0.2)# 构建完整的文件路径file_path = os.path.join(root, filename)# 准备发送的数据post_data = ["--path", file_path]try:# 发送HTTP POST请求response = send_http_post_request("http://127.0.0.1:1224/argv", post_data)# 获取响应文本并替换换行符response_text = response.text.replace('\n', ',').replace('\t','')# 将响应写入数据库write_to_database(file_path, response_text, db_config)except Exception as e:# 打印异常信息,或者根据需要处理异常print(f"Error processing file {file_path}: {e}")return truedef on_click():global entry_directorydirectory = entry_directory.get()db_host = '127.0.0.1'db_port = 3306db_user = 'root'db_password = '123456'db_name = 'xxxxx'db_config = {'host': db_host,'port': db_port,'user': db_user,'password': db_password,'db': db_name}status = returndata(directory, db_config)if status:window.destroy()def main():global windowwindow = tk.Tk()window.title("OCR识别导入")window.geometry("400x200")  # 设置窗口大小(可根据需要调整)# 添加标签和输入框label_directory = ttk.Label(window, text="请输入文件夹目录:", style="TLabel")label_directory.grid(row=0, column=0, padx=10, pady=(10, 5), sticky="w")global entry_directoryentry_directory = ttk.Entry(window, width=30, style="TEntry")entry_directory.grid(row=0, column=1, padx=(0, 10), pady=(10, 5), sticky="ew")# 添加执行按钮button_execute = ttk.Button(window, text="Execute", command=on_click, style="TButton")button_execute.grid(row=1, column=0, columnspan=2, padx=10, pady=10, ipadx=10, sticky="ew")window.mainloop()if __name__ == '__main__':main()

之后再利用

python -m pip install pyinstallerpython -m PyInstaller -F -w  --compress test.py 打包成可执行程序

这篇关于umi-ocr识别文件夹所有文件并导入数据库的文章就介绍到这儿,希望我们推荐的文章对编程师们有所帮助!



http://www.chinasem.cn/article/878188

相关文章

Spring Security基于数据库验证流程详解

Spring Security 校验流程图 相关解释说明(认真看哦) AbstractAuthenticationProcessingFilter 抽象类 /*** 调用 #requiresAuthentication(HttpServletRequest, HttpServletResponse) 决定是否需要进行验证操作。* 如果需要验证,则会调用 #attemptAuthentica

python: 多模块(.py)中全局变量的导入

文章目录 global关键字可变类型和不可变类型数据的内存地址单模块(单个py文件)的全局变量示例总结 多模块(多个py文件)的全局变量from x import x导入全局变量示例 import x导入全局变量示例 总结 global关键字 global 的作用范围是模块(.py)级别: 当你在一个模块(文件)中使用 global 声明变量时,这个变量只在该模块的全局命名空

MySQL数据库宕机,启动不起来,教你一招搞定!

作者介绍:老苏,10余年DBA工作运维经验,擅长Oracle、MySQL、PG、Mongodb数据库运维(如安装迁移,性能优化、故障应急处理等)公众号:老苏畅谈运维欢迎关注本人公众号,更多精彩与您分享。 MySQL数据库宕机,数据页损坏问题,启动不起来,该如何排查和解决,本文将为你说明具体的排查过程。 查看MySQL error日志 查看 MySQL error日志,排查哪个表(表空间

阿里开源语音识别SenseVoiceWindows环境部署

SenseVoice介绍 SenseVoice 专注于高精度多语言语音识别、情感辨识和音频事件检测多语言识别: 采用超过 40 万小时数据训练,支持超过 50 种语言,识别效果上优于 Whisper 模型。富文本识别:具备优秀的情感识别,能够在测试数据上达到和超过目前最佳情感识别模型的效果。支持声音事件检测能力,支持音乐、掌声、笑声、哭声、咳嗽、喷嚏等多种常见人机交互事件进行检测。高效推

深入理解数据库的 4NF:多值依赖与消除数据异常

在数据库设计中, "范式" 是一个常常被提到的重要概念。许多初学者在学习数据库设计时,经常听到第一范式(1NF)、第二范式(2NF)、第三范式(3NF)以及 BCNF(Boyce-Codd范式)。这些范式都旨在通过消除数据冗余和异常来优化数据库结构。然而,当我们谈到 4NF(第四范式)时,事情变得更加复杂。本文将带你深入了解 多值依赖 和 4NF,帮助你在数据库设计中消除更高级别的异常。 什么是

DM8数据库安装后配置

1 前言 在上篇文章中,我们已经成功将库装好。在安装完成后,为了能够更好地满足应用需求和保障系统的安全稳定运行,通常需要进行一些基本的配置。下面是一些常见的配置项: 数据库服务注册:默认包含14个功能模块,将这些模块注册成服务后,可以更好的启动和管理这些功能;基本的实例参数配置:契合应用场景和发挥系统的最大性能;备份:有备无患;… 2 注册实例服务 注册了实例服务后,可以使用系统服务管理,

速了解MySQL 数据库不同存储引擎

快速了解MySQL 数据库不同存储引擎 MySQL 提供了多种存储引擎,每种存储引擎都有其特定的特性和适用场景。了解这些存储引擎的特性,有助于在设计数据库时做出合理的选择。以下是 MySQL 中几种常用存储引擎的详细介绍。 1. InnoDB 特点: 事务支持:InnoDB 是一个支持 ACID(原子性、一致性、隔离性、持久性)事务的存储引擎。行级锁:使用行级锁来提高并发性,减少锁竞争

开源分布式数据库中间件

转自:https://www.csdn.net/article/2015-07-16/2825228 MyCat:开源分布式数据库中间件 为什么需要MyCat? 虽然云计算时代,传统数据库存在着先天性的弊端,但是NoSQL数据库又无法将其替代。如果传统数据易于扩展,可切分,就可以避免单机(单库)的性能缺陷。 MyCat的目标就是:低成本地将现有的单机数据库和应用平滑迁移到“云”端

ORACLE 11g 创建数据库时 Enterprise Manager配置失败的解决办法 无法打开OEM的解决办法

在win7 64位系统下安装oracle11g,在使用Database configuration Assistant创建数据库时,在创建到85%的时候报错,错误如下: 解决办法: 在listener.ora中增加对BlueAeri-PC或ip地址的侦听,具体步骤如下: 1.启动Net Manager,在“监听程序”--Listener下添加一个地址,主机名写计

MyBatis 切换不同的类型数据库方案

下属案例例当前结合SpringBoot 配置进行讲解。 背景: 实现一个工程里面在部署阶段支持切换不同类型数据库支持。 方案一 数据源配置 关键代码(是什么数据库,该怎么配就怎么配) spring:datasource:name: test# 使用druid数据源type: com.alibaba.druid.pool.DruidDataSource# @需要修改 数据库连接及驱动u