摘要:所提方案在传统解析字典算法基础上,加入局部拓扑项用以描述数据之间的结构信息,同时用l1/2范数代替 l1范数作为稀疏约束,从而提高表示系数的稀疏度。在特征提取上,融合了包含丰富运动信息的相互作用力直方图与包含纹理信息的梯度方向直方图,然后用改进的字典对特征数据进行训练,最后通过计算测试样本在该字典下的重构误差来判断测试样本是否为异常样本。在标准行为库UMN(University of Minnesota)数据库上进行的实验证实了算法具有较高的性能。与传统的算法相比,提出的改进的解析字典分类算法在针对人群异常事件中取得了更为有效的检测。
摘要:提出了结合情感词典的改进信息增益特征选择方法。首先,针对现有的信息增益特征选择存在注重特征词的文档频率而忽视语料均衡等问题,提出了改进方法。其次,考虑情感词对文本分类的影响,提出了基于情感词典的特征选择(information gain combining sentiment classification,IGSC)算法进行文本分类。该算法通过对文本情感词进行匹配并结合情感词赋权重,实现了特征降维并解决了文本数据稀疏影响分类性能的问题;最后,针对旅游评论数据集对所提出的特征选择方法进行了实验验证及分析。实验结果表明,本文提出的改进文本情感分类特征选择方法在分类准确率、召回率和F值方面均得到了提升,并且具有较好的分类稳定性。