opencv-裁剪手写行(行分割)

2024-04-20 02:50:42 发布

您现在位置:Python中文网/ 问答频道 /正文

我正在尝试使用python和opencv构建一个手写识别系统。 字符的识别不是问题,而是分割。 我成功地:

  • 把一个单词分割成单个字符
  • 按所需顺序将一个句子分割成单词。

但我无法在文件中分割不同的行。我试着对轮廓进行排序(避免线分割,只使用分词),但没有成功。 我使用了以下代码对手写文档中包含的单词进行了分段,但它会返回无序的单词(它以从左到右排序的方式返回单词):

import cv2
import numpy as np
#import image
image = cv2.imread('input.jpg')
#cv2.imshow('orig',image)
#cv2.waitKey(0)

#grayscale
gray = cv2.cvtColor(image,cv2.COLOR_BGR2GRAY)
cv2.imshow('gray',gray)
cv2.waitKey(0)

#binary
ret,thresh = cv2.threshold(gray,127,255,cv2.THRESH_BINARY_INV)
cv2.imshow('second',thresh)
cv2.waitKey(0)

#dilation
kernel = np.ones((5,5), np.uint8)
img_dilation = cv2.dilate(thresh, kernel, iterations=1)
cv2.imshow('dilated',img_dilation)
cv2.waitKey(0)

#find contours
im2,ctrs, hier = cv2.findContours(img_dilation.copy(), cv2.RETR_EXTERNAL, cv2.CHAIN_APPROX_SIMPLE)

#sort contours
sorted_ctrs = sorted(ctrs, key=lambda ctr: cv2.boundingRect(ctr)[0])

for i, ctr in enumerate(sorted_ctrs):
    # Get bounding box
    x, y, w, h = cv2.boundingRect(ctr)

    # Getting ROI
    roi = image[y:y+h, x:x+w]

    # show ROI
    cv2.imshow('segment no:'+str(i),roi)
    cv2.rectangle(image,(x,y),( x + w, y + h ),(90,0,255),2)
    cv2.waitKey(0)

cv2.imshow('marked areas',image)
cv2.waitKey(0)

请注意,我可以将这里的所有单词都分段,但它们看起来是无序的。有没有办法按从上到下的顺序对这些轮廓进行排序

将图像分割成单独的行,以便使用上述代码将每一行分割成单词?


Tags: imageimportimg排序np单词cv2sorted
1条回答
网友
1楼 · 发布于 2024-04-20 02:50:42

我通过修改上面的代码得到了所需的分段:

kernel = np.ones((5,5), np.uint8)

我改成了:

kernel = np.ones((5,100), np.uint8)

现在我得到如下输出segmented lines of input text 这也适用于线条不是完全水平的手写文本图像:

编辑: 要从单词中提取单个字符,请执行以下操作:

  1. 使用以下代码调整包含单词的轮廓的大小。

    im = cv2.resize(image,None,fx=4, fy=4, interpolation = cv2.INTER_CUBIC)
    
  2. 应用与直线分割相同的轮廓检测过程,但核大小为(5,5),即:

    kernel = np.ones((5,5), np.uint8)
    img_dilation = cv2.dilate(im_th, kernel, iterations=1)
    

相关问题 更多 >