基于空间向量模型的垃圾文本过滤方法
来源期刊:湖南科技大学学报自然科学版2014年第1期
论文作者:吴玮
文章页码:78 - 83
关键词:空间向量模型;垃圾文本;分类;过滤;
摘 要:针对垃圾文本识别计算的需求特性,应用VSM文本聚类算法思想,综合现有TFIDF算法特点,提出一种基于VSM和改进的TFIDF特征项提取算法.本方法在对垃圾文本高聚类特征项权值进行放大的同时,有效减小由二类数据样本数量偏差对计算结果带来的影响,提高了垃圾文本过滤识别效率和准确率.为垃圾文本识别提供了一种新的改进算法选择.
吴玮
苏州工业职业技术学院软件与服务外包学院
摘 要:针对垃圾文本识别计算的需求特性,应用VSM文本聚类算法思想,综合现有TFIDF算法特点,提出一种基于VSM和改进的TFIDF特征项提取算法.本方法在对垃圾文本高聚类特征项权值进行放大的同时,有效减小由二类数据样本数量偏差对计算结果带来的影响,提高了垃圾文本过滤识别效率和准确率.为垃圾文本识别提供了一种新的改进算法选择.
关键词:空间向量模型;垃圾文本;分类;过滤;