收藏本站
《内容计算的研究与应用前沿——第九届全国计算语言学学术会议论文集》2007年
收藏 | 手机打开
二维码
手机客户端打开本文

中文命名实体识别系统的领域扩展

徐薇  付滨  刘柳  苑春法  李文捷  
【摘要】:本文利用条件随机场模型实现了一个金融领域到通用新闻领域的中文命名实体识别系统领域扩展方案, 并对如利用分词和词性标注信息进行了深入的研究。原系统针对金融领域,在分词阶段利用各类专名词典识别专名,然后利用独立的基于人工规则的模块识别公司名。本文利用条件随机场在领域扩展的情况下改善了中文命名实体的识别性能。在 ACE 命名实体识别评测数据、人民日报语料库、金融新闻语料库上进行的初步实验表明,扩展后的系统在金融和通用新闻领域均可以达到较高的召回率和准确性。

手机知网App
【参考文献】
中国期刊全文数据库 前1条
1 王宁,葛瑞芳,苑春法,黄锦辉,李文捷;中文金融新闻中公司名的识别[J];中文信息学报;2002年02期
【共引文献】
中国期刊全文数据库 前5条
1 张永奎,赵辄谦,白丽君,陈鑫卿;基于互联网的中文问答系统[J];计算机工程;2003年15期
2 庄明,老松杨,吴玲达;一种统计和词性相结合的命名实体发现方法[J];计算机应用;2004年01期
3 钟良伍;郑方;;基于中文机构名简称的检索方法研究[J];中文信息学报;2007年01期
4 俞鸿魁;张华平;刘群;吕学强;施水才;;基于层叠隐马尔可夫模型的中文命名实体识别[J];通信学报;2006年02期
5 张占英,王中立;中文文本中公司名简称的识别[J];许昌学院学报;2003年02期
中国重要会议论文全文数据库 前10条
1 Abdul-Rahim Ahmad;Otman Basir;Khaled Hassanein;;Adaptive User Interfaces for Intelligent E-Learning: Issues and Trends[A];第四届电子商务国际会议论文集(Ⅱ)[C];2004年
2 俞鸿魁;张华平;刘群;吕学强;施水才;;基于层叠隐马尔可夫模型的中文命名实体识别[A];全国网络与信息安全技术研讨会'2005论文集(下册)[C];2005年
3 刘俊;张益肇;;基于统计的中文姓名提取方法[A];第六届全国人机语音通讯学术会议论文集[C];2001年
4 Jimin Liu, Jing Xiao and Tat-Seng Chua School of Computing, National University of Singapore;Finding Names in Chinese Text using a Hybrid Rule Induction Model[A];第一届学生计算语言学研讨会论文集[C];2002年
5 吴雪军;朱靖波;王会珍;叶娜;张宇新;;Co-Training的机器学习方法在中文机构名识别中的应用[A];语言计算与基于内容的文本处理——全国第七届计算语言学联合学术会议论文集[C];2003年
6 俞鸿魁;张华平;刘群;;基于角色标注的中文机构名识别[A];Advances in Computation of Oriental Languages--Proceedings of the 20th International Conference on Computer Processing of Oriental Languages[C];2003年
7 Honglei Guo Jianmin Jiang Gang Hu IBM China Research Laboratory, HaoHai Building, No.7, 5th Street, ShangDi, Beijing, 100085 Tong Zhang IBM T.J. Watson Research Center, Yorktown Heights, New York, 10598;Chinese Named Entity Recognition Based on Multilevel Linguistic Features[A];Proceedings of the Conference First International Joint Conference on Natural Language Processing[C];2004年
8 Deyi Xiong Hongkui Yu Qun Liu Digital Technology Lab Institute of Computing Technology Chinese Academy of Sciences, Beijing;Tagging Complex NEs with Maxent Models: Layered Structures versus Extended Tagset[A];Proceedings of the Conference First International Joint Conference on Natural Language Processing[C];2004年
9 李斌;;中文单字国名简称的自动识别[A];第二届全国学生计算语言学研讨会论文集[C];2004年
10 廖先桃;于海滨;秦兵;刘挺;;HMM与自动规则提取相结合的中文命名实体识别[A];第二届全国学生计算语言学研讨会论文集[C];2004年
中国博士学位论文全文数据库 前5条
1 姜吉发;自由文本的信息抽取模式获取的研究[D];中国科学院研究生院(计算技术研究所);2004年
2 张华平;语言浅层分析与句子级新信息检测研究[D];中国科学院研究生院(计算技术研究所);2005年
3 刘柏嵩;基于Web的通用本体学习研究[D];浙江大学;2007年
4 郭永辉;英汉机器翻译系统关键技术研究[D];解放军信息工程大学;2006年
5 杨志豪;面向生物医学领域的文本挖掘技术研究[D];大连理工大学;2008年
中国硕士学位论文全文数据库 前10条
1 张艳丽;中文机构名称的自动识别[D];大连理工大学;2003年
2 赵辄谦;基于互联网的中文问答系统研究[D];山西大学;2003年
3 俞鸿魁;基于层次隐马尔可夫模型的汉语词法分析和命名实体识别技术[D];北京化工大学;2004年
4 庄明;装备发展战略研究信息化平台中汉语文本信息提取技术的研究[D];国防科学技术大学;2003年
5 王兴义;基于模式匹配的中文专有名词识别[D];山西大学;2005年
6 王江伟;基于最大熵模型的中文命名实体识别[D];南京理工大学;2005年
7 吴雪军;面向信息抽取的命名实体识别与模板获取技术研究[D];东北大学;2005年
8 张晓艳;基于混合统计模型的汉语命名实体识别方法的研究与实现[D];国防科学技术大学;2004年
9 郭红梅;双语对齐技术研究[D];北京邮电大学;2006年
10 张剑;基于CRF的英文命名实体识别研究[D];哈尔滨工业大学;2006年
【二级参考文献】
中国期刊全文数据库 前1条
1 张小衡,王玲玲;中文机构名称的识别与分析[J];中文信息学报;1997年04期
【相似文献】
中国期刊全文数据库 前10条
1 葛金虎;;基于条件随机场的中文命名实体识别的研究[J];科技信息;2010年16期
2 李中言,李普跃;信息抽取方法综述[J];廊坊师范学院学报;2005年03期
3 刘海鹏;王小捷;;基于条件随机场和知识库的手机短信命名实体识别[J];广西师范大学学报(自然科学版);2009年01期
4 李桂兰;余正涛;毛存礼;郭剑毅;侯波;线岩团;;旅游领域实体答案的抽取[J];广西师范大学学报(自然科学版);2009年01期
5 佘俊;张学清;;音乐命名实体识别方法[J];计算机应用;2010年11期
6 金明;杨欢欢;单广荣;;藏语命名实体识别研究[J];西北民族大学学报(自然科学版);2010年03期
7 邱莎;;几种基于机器学习的生物命名实体识别模型比较[J];电脑知识与技术(学术交流);2007年05期
8 林旭东;彭宏;林丕源;邓健爽;;基于依存关系的问句理解与问句分类[J];计算机科学;2007年07期
9 许晓丽;卢志茂;张格森;;基于条件随机场的中文命名实体识别研究[J];中国新技术新产品;2009年02期
10 林旭东;孙爱东;林丕源;刘汉兴;;基于依存关系与支持向量机的中文问题分类方法[J];郑州大学学报(理学版);2009年01期
中国重要会议论文全文数据库 前10条
1 徐薇;付滨;刘柳;苑春法;李文捷;;中文命名实体识别系统的领域扩展[A];内容计算的研究与应用前沿——第九届全国计算语言学学术会议论文集[C];2007年
2 董俊林;聂伟;杨君英;张春炉;;命名实体识别与提取分析[A];逻辑学及其应用研究——第四届全国逻辑系统、智能科学与信息科学学术会议论文集[C];2008年
3 李渝勤;孙丽华;;面向互联网舆情的热词分析技术[A];第六届全国信息检索学术会议论文集[C];2010年
4 张佳宝;周斌;吴泉源;;基于Hadoop的并行化命名实体识别技术研究与实现[A];全国计算机安全学术交流会论文集·第二十五卷[C];2010年
5 齐振宇;赵军;杨帆;;一种开放式中文命名实体识别的新方法[A];第五届全国信息检索学术会议论文集[C];2009年
6 翟海军;郭嘉丰;王小磊;许洪波;;基于用户查询日志的命名实体挖掘[A];中国计算机语言学研究前沿进展(2007-2009)[C];2009年
7 向晓雯;史晓东;曾华琳;;一个统计与规则相结合的中文命名实体识别系统[A];第六届汉语词汇语义学研讨会论文集[C];2005年
8 俞鸿魁;张华平;刘群;吕学强;施水才;;基于层叠隐马尔可夫模型的中文命名实体识别[A];全国网络与信息安全技术研讨会'2005论文集(下册)[C];2005年
9 陈禹;史晓东;向晓雯;张润延;;基于混合方法的中文命名实体识别[A];内容计算的研究与应用前沿——第九届全国计算语言学学术会议论文集[C];2007年
10 张祝玉;任飞亮;朱靖波;;基于条件随机场的中文命名实体识别特征比较研究[A];第四届全国信息检索与内容安全学术会议论文集(上)[C];2008年
中国博士学位论文全文数据库 前10条
1 江会星;汉语命名实体识别研究[D];北京邮电大学;2012年
2 罗芳;意见挖掘中若干关键问题研究[D];武汉理工大学;2011年
3 李彦鹏;特征耦合泛化及其在文体挖掘中的应用[D];大连理工大学;2011年
4 钱伟中;基于判别式模型的蛋白质互作用文本挖掘技术研究[D];电子科技大学;2011年
5 张素香;信息抽取中关键技术的研究[D];北京邮电大学;2007年
6 杨尔弘;突发事件信息提取研究[D];北京语言大学;2005年
7 陈慧;基于DCC动态流通语料库的中文组织名考察与研究[D];北京语言大学;2008年
8 高红;基于统计语言模型的汉语浅层分析研究[D];大连理工大学;2007年
9 杨志豪;面向生物医学领域的文本挖掘技术研究[D];大连理工大学;2008年
10 史树敏;基于领域本体的汉语共指消解及相关技术研究[D];南京理工大学;2008年
中国硕士学位论文全文数据库 前10条
1 周昆;基于规则的命名实体识别研究[D];合肥工业大学;2010年
2 孙静;基于组合分类器的生物命名实体识别[D];大连理工大学;2010年
3 孟迎;基于统计的机器学习的中文命名实体识别[D];昆明理工大学;2004年
4 江超男;面向社会网络应用的关系抽取研究[D];南京理工大学;2010年
5 陈扬;基于命名实体识别的学科智能答疑模型研究[D];东北师范大学;2010年
6 王江伟;基于最大熵模型的中文命名实体识别[D];南京理工大学;2005年
7 张晓艳;基于混合统计模型的汉语命名实体识别方法的研究与实现[D];国防科学技术大学;2004年
8 向晓雯;基于条件随机场的中文命名实体识别[D];厦门大学;2006年
9 陈禹;基于语篇的中文命名实体识别研究[D];厦门大学;2008年
10 俞鸿魁;基于层次隐马尔可夫模型的汉语词法分析和命名实体识别技术[D];北京化工大学;2004年
 快捷付款方式  订购知网充值卡  订购热线  帮助中心
  • 400-819-9993
  • 010-62791813
  • 010-62985026