网站首页 > 技术文章 正文
cnocr的介绍可见:
更好用的开源Python OCR工具包:CnOCR V2.2
自动对截屏图片进行文字识别(OCR)
我自己有对截屏图片进行文字识别的需求,比如遇到某些网站不让拷贝,或者识别分享视频中的某个文字信息等。之前我都是用QQ自带的截屏识别功能来完成整个操作的,但是流程比较麻烦。
为什么不装一个对应的app?大部分免费的app后面其实都是调用的大公司的AI平台的接口,还得去折腾平台app key,怪麻烦的而且还无法离线使用。要么就是限制调用次数。当然,另一个原因是我一直期望用自己开发的 cnocr 来完成这个功能,eat your own dog food 嘛,自己不用的东西肯定没前途。
之前考虑过搞个浏览器插件或者做个系统应用来完成这个功能,但我对系统应用开发一窍不通而且前端技术也只了解基础的html和css,所以还是放弃了。欢迎大家朝着这个方向做些工作。
现在的实现方法很简单,各个系统(Windows、Mac、Linux)的截屏应用有很多很好用的,基本都有把截屏图片存储在指定位置这个功能。基于这个功能,我只要搞个守护进程轮询去查看是否有刚更新的图片,如果有就把它拿给cnocr识别下,然后把识别的结果复制进系统的剪切板即可。
怎么搭起来这个功能呢?开始之前先确保你的 cnocr v2.2版已经安装成功,否则请参考 安装文档 搞定cnocr最新版的安装。
以下是具体的搭建流程:
1. 找一个用得惯的截屏软件,这个软件只要支持把截屏图片存储在指定位置即可。比如Mac下我用的是免费的 Xnip 。
2. 除了安装cnocr v2.2外,这里面需要额外安装一个python包 pyperclip,利用它把ocr结果复制进系统的剪切板:
> pip install pyperclip
3. 拷贝下面的代码,存储到新文件 screenshot_daemon.py 。编辑此文件 "SCREENSHOT_DIR" 所在行,把路径改为你的截屏图片所存储的目录。
# coding: utf-8
# Copyright (C) 2022, [Breezedeus](https://github.com/breezedeus).
import os
import time
import glob
from pprint import pformat
import pyperclip as pc
from cnocr import CnOcr
from cnocr.utils import set_logger
logger = set_logger(log_level='DEBUG')
SCREENSHOT_DIR = os.getenv(
"SCREENSHOT_DIR", '<你的截屏图片存储目录>' # ==> 换成你的目录
)
OCR_MODEL = CnOcr()
def get_newest_fp_time(screenshot_dir):
fn_list = glob.glob1(screenshot_dir, '*g')
fp_list = [os.path.join(screenshot_dir, fn) for fn in fn_list]
if not fp_list:
return None, None
fp_list.sort(key=lambda fp: os.path.getmtime(fp), reverse=True)
return fp_list[0], os.path.getmtime(fp_list[0])
def ocr_newest(screenshot_dir, delta_interval):
while True:
newest_fp, newest_mod_time = get_newest_fp_time(screenshot_dir)
if (
newest_mod_time is not None
and time.time() - newest_mod_time < delta_interval
):
logger.info(f'analyzing screenshot file {newest_fp}')
result = OCR_MODEL.ocr(newest_fp)
texts = [_one['text'] for _one in result]
logger.info(f'\tOCR results: {pformat(texts)}\n\n')
if texts:
pc.copy('\n'.join(texts))
time.sleep(1)
if __name__ == '__main__':
ocr_newest(SCREENSHOT_DIR, 2)
4. 运行此脚本文件,all done:
> python screenshot_daemon.py
接下来就是享受随时ocr的乐趣了:
欢迎大家尝试,遇到问题可以评论,感谢。
知识星球私享群
此文初始发表于 知识星球CnOCR/CnSTD私享群 (
https://wx.zsxq.com/dweb2/index/group/28858522821151) 。知识星球私享群会陆续发布一些CnOCR/CnSTD相关的私有资料,包括更详细的训练教程,各种资源福利,使用过程中遇到的疑难解答等。本群也会发布OCR/STD相关的最新研究资料。欢迎感兴趣的朋友加入。
猜你喜欢
- 2024-11-23 VC.NET全屏截屏或鼠标拖动出区域,截图效果「附源码」
- 2024-11-23 Star 17.3k!给它一张屏幕截图,即可一键克隆网页!
- 2024-11-23 一个好的前端年薪会有多少钱?
- 2024-11-23 57挑战之53,python实现客户端+服务端
- 2024-11-23 6个月转行成功WEB前端工程师的秘诀在这里
- 2024-11-23 分享 12 个超级实用的前端工具,可能就是你一直在寻找的!
- 2024-11-23 超级实用的截图工具分享—Snipaste
- 2024-11-23 前端革命时刻:前端代码是怎样智能生成的-图像分离篇
- 2024-11-23 推荐给前端开发的 5 款 Chrome 扩展
- 2024-11-23 这4个神器,帮你自动美化生成好看的网页截图
你 发表评论:
欢迎- 07-10Oracle 与 Google Cloud 携手大幅扩展多云服务
- 07-10分享收藏的 oracle 11.2.0.4各平台的下载地址
- 07-10Oracle 和 Microsoft 推出 Oracle Exadata 数据库服务
- 07-10Oracle Database@Azure 推进到南美等新区域并增加了新服务
- 07-10Oracle宣布推出 Oracle Database@AWS 的有限预览版
- 07-10Oracle与Nextcloud合作,推出主权云上的安全协作平台
- 07-10NodeRED魔改版连接MsSql、PostgreSQL、MySQL、OracleDB存储无忧
- 07-10对于企业数据云备份,“多备份”承诺的是成本更低,管理更高效#36氪开放日深圳站#
- 601℃几个Oracle空值处理函数 oracle处理null值的函数
- 593℃Oracle分析函数之Lag和Lead()使用
- 581℃0497-如何将Kerberos的CDH6.1从Oracle JDK 1.8迁移至OpenJDK 1.8
- 578℃Oracle数据库的单、多行函数 oracle执行多个sql语句
- 573℃Oracle 12c PDB迁移(一) oracle迁移到oceanbase
- 566℃【数据统计分析】详解Oracle分组函数之CUBE
- 553℃最佳实践 | 提效 47 倍,制造业生产 Oracle 迁移替换
- 547℃Oracle有哪些常见的函数? oracle中常用的函数
- 最近发表
-
- Oracle 与 Google Cloud 携手大幅扩展多云服务
- 分享收藏的 oracle 11.2.0.4各平台的下载地址
- Oracle 和 Microsoft 推出 Oracle Exadata 数据库服务
- Oracle Database@Azure 推进到南美等新区域并增加了新服务
- Oracle宣布推出 Oracle Database@AWS 的有限预览版
- Oracle与Nextcloud合作,推出主权云上的安全协作平台
- NodeRED魔改版连接MsSql、PostgreSQL、MySQL、OracleDB存储无忧
- 对于企业数据云备份,“多备份”承诺的是成本更低,管理更高效#36氪开放日深圳站#
- 解读丨《归档文件整理规则》— 电子文件元数据存储
- Data Guard跳归档恢复的实践(dataguard failover)
- 标签列表
-
- 前端设计模式 (75)
- 前端性能优化 (51)
- 前端模板 (66)
- 前端跨域 (52)
- 前端缓存 (63)
- 前端aes加密 (58)
- 前端脚手架 (56)
- 前端md5加密 (54)
- 前端路由 (61)
- 前端数组 (73)
- 前端js面试题 (50)
- 前端定时器 (59)
- 前端获取当前时间 (50)
- Oracle RAC (76)
- oracle恢复 (77)
- oracle 删除表 (52)
- oracle 用户名 (80)
- oracle 工具 (55)
- oracle 内存 (55)
- oracle 导出表 (62)
- oracle约束 (54)
- oracle 中文 (51)
- oracle链接 (54)
- oracle的函数 (57)
- 前端调试 (52)
本文暂时没有评论,来添加一个吧(●'◡'●)