有效
一种自然场景图像中的英文文字和数字识别方法
摘要
本发明提供一种自然场景图像中的英文文字与数字识别方法,将自然场景中的英文文字和数字的识别问题分为特征提取,特征聚焦和特征识别三个步骤,利用卷积神经网络对输入图像进行特征提取,注意力机制对特征序列中的有用信息进行聚焦,长短时记忆网络对特征向量进行识别,从而将深度神经网络和注意力机制结合,当输入图像到深度神经网络时,可以直接得出最终的识别结果。本发明不需要对输入图像进行滑窗操作并对窗口中的字符进行识别;同时本发明输出的字符串即为最终的识别结果,不需要合并算法对识别后的字符串进行整合。



