基于反馈学习自适应的中文话题追踪

来源 :第二届全国信息检索与内容安全学术会议 | 被引量 : 0次 | 上传用户：zhaojian1990

【摘要】

：

话题追踪技术能够帮助人们从浩瀚的信息中获得自己感兴趣的内容.由于话题是动态发展的,在追踪过程中会产生话题漂移的问题.针对该问题以及现有自适应方法的不足本文提出了一

【作者】

：

王会珍[1]朱靖波[1]季铎[1]叶娜[1]张斌[2]

【机构】

：

东北大学信息学院自然语言处理实验室,沈阳,110004

【出处】

：

第二届全国信息检索与内容安全学术会议

【发表日期】

：

2005年期

下载到本地 , 更方便阅读

下载此文赞助VIP

声明 : 本文档内容版权归属内容提供方 , 如果您对本文有版权争议 , 可与客服联系进行内容授权或下架

论文部分内容阅读

话题追踪技术能够帮助人们从浩瀚的信息中获得自己感兴趣的内容.由于话题是动态发展的,在追踪过程中会产生话题漂移的问题.针对该问题以及现有自适应方法的不足本文提出了一种新的自适应方法--基于反馈学习的自适应方法.该方法采用增量学习的思想,对话题追踪任务中的自适应学习机制提出了新的算法.该算法能够解决话题漂移现象,并能够弥补现有自适应方法的不足.该算法中还考虑了话题追踪任务的时序性,将时间信息引入到了算法中.本文实验采用TDT4语料中的中文部分作为测试语料,使用TDT2004的评测方法对基于反馈学习的自适应的中文话题追踪系统进行评价,实验数据表明基于反馈学习的自适应方法能够提高话题追踪的性能.本文还考察了打分归一化对话题追踪性能的影响.

其他文献

Schema引导的多媒体标注技术

以MPEG-7为主要技术背景的基于内容的多媒体检索,主要用来描述低层语义的问题,它的缺陷是对高级语义的支持不足,无法建立对多媒体相关行业复杂元数据的支持.本文提出了一个基

会议

基于GNPIMk和SVM的文本图像检索

由于图像的底层统计特征与高层语义特征之间存在一道鸿沟,计算机难以直接完成基于语义的文本图像检索.因此,文本图像检索的性能很大程度上依赖于底层统计特征的提取.针对该问

会议

文本图像图像检索图像信息度量支持向量机广义归一化统计特征高层语义特征向量检索技术正确率计算机征之性能网络提取实验鸿沟程度

一种基于局部共现的查询扩展方法

针对信息检索中文档与查询之间的词不匹配问题,本文提出了一种基于局部共现的查询扩展方法LOCOOC.LOCOOC利用词项与所有查询词在局部文档集合中的共现程度来评估扩展词的质量

会议

一种改进的文本分类方法的研究

文本分类是自然语言处理的一个重要研究方向,它可以有效的解决信息杂乱的现象,并有助于用户发现所需的信息.特征选择和权值函数是文本分类的核心,通过对经典的TF-IDF函数和互

会议

文本分类信息因子特征选择自然语言处理算法研究方向选择方法信息特征实验验证权值函数类间分布证明用户精度经典

基于数据挖掘等技术的半分布式搜索引擎模型

本文提出了一种基于数据挖掘与智能学习技术的半分布式搜索引擎(SDSE,Semi-DistributedSearchEngine)模型,实现的系统称为PeerSearch.模型设计的主要目的:φ充分利用用户的智

会议

基于短语匹配的中文Web文档聚类算法

本文在一种采用图结构、基于短语的文档索引模型的基础上,提出了一种基于短语匹配的、在线的、无需进行中文分词的增量聚类算法来对中文搜索结果进行聚类.结合文档索引模型和

会议

短语匹配中文分词索引模型增量聚类算法自动分类文档搜索引擎搜索结果增量式图结构基础

一个基于最大熵模型的文本分类方法

本文提出了一种应用最大熵模型进行中文文本分类的方法,该方法重点在于特征函数的构建和文本的预处理这两个方面.本文把文档的预处理分为网页去标记、分词、去虚词和去停用词

会议

类别主特征结合句法特征的中文问题层次分类

问题分类是问答系统中重要的组成部分,问题分类结果的好坏直接影响问答系统的性能.本文提出了一种新的问题层次分类方法,该方法结合类别主特征与问题句法特征,对满足类别临界

会议

问题分类临界条件类别主特征句法特征贝叶斯分类器

中文文本聚类的特征单元比较

本文对字、词和字串等文本特征在中文文本聚类中的效果进行了比较实验.实验使用K-MEANS聚类方法,检验了字特征、字串特征、词特征以及它们的组合方式的聚类效果.

会议

中文文本聚类字串特征组合方式文本特征比较实验聚类效果聚类方法词特征和字

面向支持向量机的降维方法比较分析

支持向量机是文本分类领域在广泛采用的分类模型,应用于支持向量机的特征降维方法也成为了研究热点.本文考察了信息增益、文档频度、x2统计和潜在语义索引几种特征降维方法,

会议

支持向量机文本分类特征降维潜在语义索引

基于反馈学习自适应的中文话题追踪

其他学术论文