本文件涉及计算机,尤其涉及一种利用视觉特征优化文本识别或处理的方法及系统。
背景技术:
1、计算机视觉识别技术是指利用计算机科学和人工智能技术,通过对数字图像或视频的处理和分析,自动地识别图像和视频中的内容和特征。
2、计算机视觉识别技术已经广泛应用于人脸识别、文字识别、物体识别、场景识别、医疗诊断等领域,成为了现代社会数字化转型的重要组成部分。
3、各文本识别方法或产品对不同文本的识别能力有差异,对于特定的文本使用识别能力更好的识别方法或产品,可以提高文本的识别率,例如,目前对中文、英文、数字、表格都有专门的方法或产品进行识别。同时,不同的文本识别产品(包括但不限于提供文本识别能力的软件、硬件或服务)的使用成本也是不同的。如果可以很方便的根据内容选择文本识别方法或产品,可以为使用者带来很多方便和成本上的节约。另外,对文本进行识别之后往往要做后续的处理,如果通过扫描或者拍摄图像,就可以为计算机发出后续处理的指令,也将为使用者带来诸多便利。
4、特别是在计算机编程方面,计算机编程可以帮助人们对计算设备进行控制实现多种多样的功能,很多人包括青少年都在学习计算机编程。目前,计算机编程通常是利用键盘和显示器的组合进行录入的。
5、在阅读计算机书面教材的过程中,如果想执行示例程序,需要将示例的代码手工录入编程软件,费时费力。对示例程序进行拍照,然后ocr,可以简化录入操作,但是存在两个问题,一个是程序的缩进难以准确控制,二是程序中经常使用的部分字符识别正确率较低,需要进行逐行检查和调整才能够运行,影响了文本识别技术在程序录入环节的应用。
6、更进一步的考虑,如果我们可以通过拍照即可完成程序的录入和执行,那么我们就可以让青少年通过手写等方式录入程序,从而在不使用或者较少使用显示器的情况下学习计算机编程,可以有效的保护青少年的视力。另外,我们还可以在可编程设备上使用摄像头替代屏幕、键盘,丰富可编程设备的录入方式,从而降低成本缩小尺寸。
7、因此,我们需要一种方法,使得人们可以优化文本的识别和处理,特别是简单方便的利用视觉识别完成程序的录入和执行功能。
技术实现思路
1、本发明的目的在于提供一种利用视觉特征优化文本识别或处理的方法及系统,旨在解决现有技术中的上述问题。
2、本发明提供一种利用视觉特征优化文本识别或处理的方法,包括:
3、识别图像中的视觉特征,基于所述视觉特征获取识别结果,所述视觉特征是指图像中可以被计算机视觉识别的特征,可以是文本自身的视觉特征,例如字体颜色、文本部分的底色、文本大小等,也可以是图像中文本之外某一位置的颜色、图形等视觉特征,也可以是在图像中展示某种视觉标识形成的视觉特征,视觉标识可以包含点、线、底纹、底色、二维码、条码、图片、图形或其他可以通过计算机视觉识别的要素;
4、基于所述识别结果,确定与之对应的用于文本识别或处理的方法或产品,所述处理包括但不限于对图像或识别图像生成的文本进行保存、关联、编辑、运算、转换、生成程序语句或程序语句段落、组合、删减、编译、调试和/或执行等处理,所述方法包括但不限于方法、算法、步骤、流程、模型、技术和/或规则等,所述产品包括但不限于能够实现文本识别或文本处理或图像处理的软件、硬件或服务等;
5、利用所述用于文本识别或处理的方法或产品,识别图像生成文本,和/或对文本或图像进行处理。
6、本发明提供一种利用视觉特征优化文本识别或处理的系统,具体包括:
7、摄像装置,用于拍摄图像;
8、处理器,用于执行时实现如上述利用视觉特征优化文本识别或处理的方法的步骤。
9、本发明实施例还提供一种利用视觉特征优化文本识别或处理的系统,具体包括:
10、识别模块,用于识别图像中的视觉特征,基于所述视觉特征获取识别结果;
11、确定模块,用于基于所述识别结果,选择与之对应的用于文本识别或处理的方法或产品;
12、文本生成或处理模块,用于利用所述用于文本识别或处理的方法或产品,识别图像生成文本,和/或对所述文本或图像进行处理。
13、本发明实施例还提供一种用于书写程序语言文本的装置,具体包括:
14、程序书写区,用于书写或印制程序语句,所述印制包括但不限于打印、印刷、喷涂、盖章等方式;
15、视觉特征区,用于展示视觉特征,所述视觉特征用于确定程序书写区或程序书写区的一个或多个位置对应的用于文本识别或处理的方法或产品,所述展示是指包括但不限于书写、印制、摆放、雕刻、涂绘等任何一种可以呈现视觉特征的方式。
16、本发明实施例还提供一种电子设备,包括:存储器、处理器及存储在所述存储器上并可在所述处理器上运行的计算机程序,所述计算机程序被所述处理器执行时实现上述利用视觉特征优化文本识别或处理的方法的步骤。
17、本发明实施例还提供一种计算机可读存储介质,所述计算机可读存储介质上存储有信息传递的实现程序,所述程序被处理器执行时实现上述利用视觉特征优化文本识别或处理的方法的步骤。
18、采用本发明实施例,采用本发明实施例,可以让使用者利用视觉特征简单的变更文本识别的方法或产品,从而提升文本识别的准确率或降低使用成本,并且可以利用视觉特征生成指令对图像或已识别的文本进行处理,进一步的可以通过书写(或印制)程序文本的方式,编写并执行程序,在保护视力的同时,方便编程能力的培养。
1.一种利用视觉特征优化文本识别或处理的方法,其特征在于,包括:
2.根据权利要求1所述的方法,其特征在于,
3.根据权利要求1或2所述的方法,其特征在于,所述文本为程序语句文本,其中,各种程序语句构成要素对应相同或不同的文本识别方法或产品,所述程序语句构成元素具体包括:数字、字母、汉字、符号、函数、变量、一个或多个程序语句中的缩进信息、完整的一个或多个程序语句、一个或多个程序语句段落、构成一个或多个程序语句的任意部分和/或一个或多个程序文本中需要的特殊字符。
4.根据权利要求1或2所述的方法,其特征在于,所述方法进一步包括:
5.根据权利要求3所述的方法,其特征在于,所述方法进一步包括:
6.根据权利要求3所述的方法,其特征在于,所述方法进一步包括:
7.根据权利要求3所述的方法,其特征在于,所述方法进一步包括:
8.一种利用视觉特征优化文本识别或处理的系统,其特征在于,具体包括:
9.一种利用视觉特征优化文本识别或处理的系统,其特征在于,所述系统具体包括:
10.一种用于书写程序语言文本的装置,其特征在于,具体包括:
11.一种电子设备,其特征在于,包括:存储器、处理器及存储在所述存储器上并可在所述处理器上运行的计算机程序,所述计算机程序被所述处理器执行时实现如权利要求1至7中任一项所述的利用视觉特征优化文本识别或处理的方法的步骤。
12.一种计算机可读存储介质,其特征在于,所述计算机可读存储介质上存储有信息传递的实现程序,所述程序被处理器执行时实现如权利要求1至7中任一项所述的利用视觉特征优化文本识别或处理的方法的步骤。
