%0 Journal Article %T 基于统计分布与集合论的文本分类方法 %A 邓擘 %A 樊孝忠 %A 杨立公 %J 北京理工大学学报 %D 2006 %X 指出基于TfIdf的常用文本特征提取方法在文本分类问题中的缺陷,进而提出使用特征词的分布状态、词频和文本频三者相结合的方式提取文本特征的观点,给出了计算特征词权重的新方法,提出了新的文本分类方法.试验表明,该方法能够最大限度保留文本的特征,并且可有效避免向量空间模型中的维数灾难问题,能应用于大规模文本分类. %K 文本分类 %K 特征词 %K 词频 %K 文本频 %K 统计分布 %U http://journal.bit.edu.cn/zr/ch/reader/view_abstract.aspx?file_no=20060707&flag=1