利索能及
我要发布
收藏
专利号: 2023103182585
申请人: 浙江工业大学
专利类型:发明专利
专利状态:已下证
更新日期:2026-08-19
缴费截止日期: 暂无
联系人

摘要:

权利要求书:

1.一种基于freeman码的文档图像倾斜校正方法,其特征在于,具体包括如下步骤:S1:文档图像预处理;

将图像转成灰度图像,对灰度图像进行二值化操作以及形态学处理;

S2:图像文本连通块提取;

将复杂的文档图像中的文本连通块和其他图像连通块分开,筛选出文本连通块,去除非文本图像,减少文档图像中其他图像对算法准确度的影响,提高算法的鲁棒性;

S3:连通块图像细化处理;

对文本连通块进行细化处理,提取出文字的骨架,去除骨架中的毛刺,进一步对图像进行去噪,提高算法的准确性;

S4:倾角计算;

提取每个连通块的轮廓,使用freeman码对文本连通块轮廓进行边界跟踪,进行freeman码计算,计算每个连通块轮廓的链码值以及所占的比例,把竖向和横向方向对应的链码值个数所占比例最高对应的角度作为文档图像的倾斜角;

S5:文档图像倾斜校正;

根据步骤S4计算出的倾斜角,对文档图像进行旋转转正,进而完成该图像的倾斜校正。

2.根据权利要求1所述的一种基于freeman码的文档图像倾斜校正方法,其特征在于,在步骤S1中,所述文档图像预处理包括以下具体步骤:把原始的文档图像转成灰度图像:读取图像,检测图像的通道数,如果图像为三通道,则将其转换为单通道灰度图像;

对灰度图像进行二值化操作:通过使用全局二值化算法对图像进行二值化计算,有利于计算方便,减少文档图像收集时的光照不均的影响;

对图像进行形态学处理:对图像进行膨胀操作,使得一个字符尽可能地连接在一起;对图像进行腐蚀操作,使得左右相邻字符可以分离。

3.根据权利要求1所述的一种基于freeman码的文档图像倾斜校正方法,其特征在于,在步骤S2中,所述图像文本连通块提取包括以下具体步骤:寻找图像所有连通块:使用种子填充算法中的八连接算法,提取出所有连通域,记录每个连通域外接矩形框的面积;

提取文本连通域:使用面积阈值法去除非文本连通域,计算出所有连通块外接矩形框的平均面积,下限面积为平均面积的0.5倍,上限面积为平均面积的4倍,当连通块外接矩形框的面积在该面积范围内时,说明该连通块为文本连通块,去除图像中的非文本连通块。

4.根据权利要求1所述的一种基于freeman码的文档图像倾斜校正方法,其特征在于,在步骤S3中,所述连通块图像细化处理包括以下具体步骤:图像细化:对筛选出的文本连通块进行细化处理,使用zhang‑suen算法提取出文字骨架;

去除骨架毛刺:由于在骨架提取的过程中,由于提取方法的不同以及噪声的干扰,都会产生不同程度的毛刺,通过毛刺长度阈值判断毛刺,将其去除,提高算法的准确率。

5.根据权利要求1所述的一种基于freeman码的文档图像倾斜校正方法,其特征在于,在步骤S4中,所述倾角计算包括以下具体步骤:选定测试角度范围;

对于每个测试角,将原始的文档图像进行旋转,提取已去除毛刺的文本连通块的轮廓;

计算出每个连通块轮廓的方向,使用freeman码进行边界跟踪,计算出的freeman码值代表了该连通块的整体方向;

在每个连通块freeman码中,统计竖向和横向方向对应的链码值个数所占的比例;

如果连通块个数大于3,则去除正向链码比例最高和最低项,再取平均值,平均值最高所对应的角度则为倾斜角。