中文信息计算机自动处理的研究已有几十年的 历史 , 但至今仍有许多技术难题没有得到很好解 决 , 中文姓名自动识别问题就是其中的一个。由于 它与中文文本的自动分词一样 , 属于中文信息处理 的基础研究领域 , 因而它的研究成果直接影响到中 文信息的深层次研究。汉语的自身特点使得中文信 息自动处理大多是先对要处理的文本进行自动分词 (加入显式分割符) , 然后再在分词的基础上进行词 法、语法、语义等方面的深入分析。而在分词阶 段 , 文本中的人名、地名以及其它专有名词和生词 大多被切分成单字词 , 在这种情形下如不能很好地 解决汉语文本中专有名词生词的识别问题 , 将给其 后的汉语文本的深入分析带来难以逾越的障碍。中 文姓名的自动识别问题就是在这种背景下提出来 的。对这一问题的研究目前采用的技术中主要利用 以下几方面的信息: 姓名用字的频率信息、上下文 信息[1 ,2 ] 、语料库统计信息[2 ] 、词性信息等[3 ] 。本 文的方法是 , 首先对中文人名的构成、姓名用字的 规律及上下文文本信息特征进行充分分析 , 在此基 础上建立起两组规则集 , 将其作用于测试文本 , 获 得初步识别结果 , 再利用大规模语料库的统计信息 对初步识别结果进行概率筛选 , 设定合适的阈值 , 输出最终识别结果。经对 50 多万字的开放语料测 试 , 系统自动识别出 1781 个中文人名 , 在不同的 筛选阈值下获得 90 %以上的识别准确率 , 而召回 率高于 91 %。
2021-02-23 23:09:01 83KB 中文分词 搜索引擎 人名 自动
1
c#图片文字-字母-数字自动识别-深入代码-非常好
1
linux下实现自动查找U盘,识别U盘,判断是否已经挂载(如果没有则自动挂载),然后在U盘创建文件,最后卸载U盘。 纯C代码,全部源代码,可以在fedora等桌面linux上使用,也可以在嵌入式linux下使用,测试通过。 基本原理是: 1)打开 /proc/scsi/usb-storage 目录,如果能打开说明有U盘或者移动硬盘接入,否则没有 如果有则获取移动设备的设备号,就是文件名,打开这个文件名从里面可以提前设备的序列号 2)根据设备号,在/sys/class/scsi_device/目录去找,找以该设备号开头的文件夹 这个时候需要遍历这些文件夹了 3)遍历过程: 打开其下的device目录,得到子目录的名字,检测是否有block文件夹,如果没有不是U盘或者移动硬盘 如果有,继续打开block文件夹,得到其下的字母,这个时候应该出现sdx的文件夹 如果有,继续打开sdx文件夹,查找sdxn的文件,如果有这个文件夹名就是所需要的u盘盘符 4)得到的U盘的盘符后,就可以执行挂载操作 5)挂载之后,就可以拷贝文件等操作 5)文件操作完成之后卸载U盘 该demo实现了上述全部流程。
2021-02-20 15:04:19 4KB linux C源代码 U盘 自动识别
1
Matlab交通标志识别系统,bp,模版,可自动识别禁令,警示等表示。带gui界面。
2021-02-18 15:11:40 918KB Matlab交通标志识别 Matlab bp bp模版
1
一、课题背景 在现代教育事业的飞速发展中,考试已经成为现代教育事业中最公平的方式方法,而且也是衡量教与学的唯一方法。通过考试成绩的好与坏,老师和家长可以分析出学生掌握的知识多少和学习情况。从而老师可以了解到自己教学中的不足来改进教学的方式方法,提高教学的水平。学生也可以通过考试了解到自身学习的不足,从而有针对性的进行学习。考试也是进行人才的选拔和评价的重要方法。不论是找工作应聘,还是单位内部的晋升都需要进行考试。 由于考试具有一定的特殊性,而且考试必须要公平公正,当然其中最重要的就是阅卷的准确性。考生做好了题,这时就需要改卷老师阅卷的准确性,这样才能更准确的给考生真实的分数。传统的阅卷方式为流
1
Matlab有关车牌汉字识别-标准汉字的自动识别.pdf 我这有一些汉字识别文献    需要的可以看看
2020-03-27 03:14:22 113KB matlab
1
好东西!有源代码,参考文献!非常详细,写的还可以吧!
2020-01-14 03:05:18 1.07MB 车牌识别
1
该代码为基于python+opencv的目标图像区域自动提取,即利用python +opencv检测图像中的长方形画布或纸张并提取图像内容,经过测试,该算法代码能有效解决基本问题。亲测好用,大家快来下载吧,挺不错的一个资源哦!!
2020-01-08 03:12:34 83.74MB 人工智能
1
用于下载读秀的包库全文,方法如下: 1、用浏览器(推荐chrome)进入读秀,搜索然后开始浏览包库书籍 2、在浏览器的阅读界面上,右键点击,选择“复制图片地址” 3、将浏览器的cookie另存为“cookies.txt”(chrome推荐使用扩展“Export cookies.txt”,Firefox推荐使用扩展“Export cookies”) 4、将2中复制的图片地址粘贴到附件DownloadDuXiu.sh的第三行, 原来第三行为:url='http://img.sslibrary.com/n........./$nn?zoom=2' 粘贴位置:url='您所复制的图片地址粘贴在这里,请保留两边的单引号' 5、修改上述地址中的页码和图片尺寸: 原来可能为类似于“000002?zoom=0”修改为“$nn?zoom=2” 6、修改第6、7、10行的数字为对应书的前言页数、目录页数、正文页数 7、请确保第11行的cookiefile指向步骤3中保存的cookie文件 8、用linux或cygwin(windows下) 运行DownloadDuXiu.sh 9、当下载页数太多是,会出现需要验证码的情况。脚本会提示失败,请用浏览器翻页,并填写验证码。然后重新启动DownloadDuXiu.sh,脚本会从刚才中断的地方开始,继续下载 另外,脚本没有做验证码的自动识别,欢迎有兴趣的同学加入
2020-01-03 11:21:23 2KB bash download
1
里面包含了整个开发过程的思路和备注文档,非常详细,每一步怎么做都写的很详细,程序代码也非常规范,代码注释也很详细。功能实现了车牌的灰度化,二值化,提取顶点,定位车牌位置,提取车牌,保存提取出来的车牌等功能
2019-12-21 22:22:41 8.38MB 车牌识别定位
1