%0 Journal Article %T 利用串匹配技术实现网上新闻的主题提取 %A 尹中航? %A 王永成? %A 蔡巍? %A 韩客松? %J 软件学报 %P 159-167 %D 2002 %X 从文本中提取主题串是自然语言处理的重要基础之一.传统的提取方法主要是依据"词典加匹配"的模式.由于词典的更新速度无法同步于网上新闻中新词汇涌现的速度,而且词典的内容也无法完全涵盖网上新闻的范围,因此这种方法不适用于网上新闻的主题提取.提出并实现了一种不用词典即可提取新闻主题的新方法.该方法利用网上新闻的特殊结构,在标题和正文间寻找重复的字串.经过简单地处理,这些字串能够较好地反映新闻的主题.实验结果显示该方法能够准确、有效地提取出绝大部分网上新闻的主题,满足新闻自动处理的需要.该方法同样适用于其它亚洲语言和西方语言. %K 网页信息处理 %K 网上新闻 %K 主题提取 %K 串匹配 %K 词 %U http://www.jos.org.cn/ch/reader/view_abstract.aspx?file_no=20020201&flag=1