基于合成样本和MCE准则下判别学习的汉字手写文本识别研究
批准号:
60975020
项目类别:
面上项目
资助金额:
32.0 万元
负责人:
张田文
依托单位:
学科分类:
模式识别与数据挖掘
结题年份:
2012
批准年份:
2009
项目状态:
已结题
项目参与者:
郭恒业、金胜军、赵巍、刘鹏、陈冬、蔺想红、杨林
中文摘要
在手写文本库的支持下,从无切分的全新角度研究真实手写环境中的脱机汉字识别,是汉字手写识别从孤立汉字走向真实文本这一新里程的核心技术。无切分策略是把字符切分阶段和识别阶段合二为一,并进行联合优化,旨在充分利用手写文本行的整体信息,这一策略的可行性和有效性,以及与现有切分策略的互补性已经在前期研究工作中得到证实。本项目将在此基础上,研究汉字手写文本识别中的三项关键技术:1).建立中文手写文本库HIT-MW(第二版),并对保证手写文本库的代表性、典型性的方法和验证机制进行研究;2).研究汉字手写样本合成理论,通过建立自学习、自适应的合成样本,有效克服库中存在的数据稀疏问题;3).研究基于最小分类错误准则的判别学习方法,有望解决无切分识别策略的松散训练结构,提高字符模型的区分能力。本项目为进一步研究汉字手写文本识别的系综分类理论奠定坚实的理论基础,并为汉字手写识别的各种应用提供有力的技术支持。
英文摘要
从无切分的全新角度研究真实手写环境中的脱机汉字识别,是汉字手写识别从孤立汉字走向真实文本这一新里程的核心技术。无切分策略是把字符切分阶段和识别阶段合二为一,并进行联合优化,旨在充分利用手写文本行的整体信息,这一策略的可行性和有效性,以及与现有切分策略的互补性已经在前期研究工作汇总得到证实。. 本项目研究汉字手写文本识别中的三项关键技术:1)扩建中文手写文本库HIT-MW;2)研究汉字手写样本合成理论,通过建立合成样本,有效克服库中存在的数据稀疏问题;3)研究基于最小分类错误准则的判别学习方法,提高字符模型的区分能力。本项目为进一步研究汉字手写文本识别的系综分类理论奠定坚实的理论基础,并为汉字手写识别的各种应用提供有力的技术支持。
期刊论文列表
专著列表
科研奖励列表
会议论文列表
专利列表
DOI:
--
发表时间:
--
期刊:
Pattern Recognition
影响因子:
8
作者:
[苏统华, 张田文]
通讯作者:
张田文
最优小波自适应图像压缩的关键技术研究
-
批准号:60475011
-
项目类别:面上项目
-
资助金额:23.0万元
-
批准年份:2004
-
负责人:张田文
-
依托单位:
基于小波变换和卡尔曼滤波的动态轮廓线跟踪方法
-
批准号:60075010
-
项目类别:面上项目
-
资助金额:17.0万元
-
批准年份:2000
-
负责人:张田文
-
依托单位:
基于多分辨率机制的主动轮廓线跟踪方法的研究
-
批准号:69775007
-
项目类别:面上项目
-
资助金额:9.0万元
-
批准年份:1997
-
负责人:张田文
-
依托单位:
基于相似原理的三维目标匹配及其反馈机制的研究
-
批准号:69175004
-
项目类别:面上项目
-
资助金额:3.5万元
-
批准年份:1991
-
负责人:张田文
-
依托单位:
国内基金
海外基金