摘要:为了提升用户体验,降低运营商的成本,将播放最多的视频内容提前放入用户侧缓存是业界的通用做法,如何有效预测视频播放热度已经成为业界热点问题。针对传统预测算法非线性映射能力差、预测精度低及自适应性弱等缺点,提出基于神经网络与马尔可夫组合模型的视频流行度预测算法(Mar-BiLSTM),该算法通过构建双向长短期记忆(bi-directional long short-term memory,BiLSTM)网络模型可以保留时间序列两个方向的信息依赖;同时在避免引入外部变量导致模型复杂度增加的情况下,利用马尔可夫性质进一步提高了模型的预测精度。实验结果表明,与传统的时间序列和经典的神经网络算法相比,所提算法提升了视频流行度预测的准确性、时效性,并降低了计算量。
摘要:复杂视觉场景下存在过暗或者过曝的光照、恶劣的天气、严重遮挡、行人尺寸差别大以及图像模糊等问题,大大增加了行人检测的难度。因此,针对复杂视觉场景下行人检测准确度低、漏检严重的问题,提出了改进的YOLOv4算法以增强复杂视觉场景下的行人检测效果。首先,构建复杂视觉场景下的行人数据集。然后,在主干网中加入混合空洞卷积,提高网络对行人特征的提取能力。最后,提出空间锯齿空洞卷积结构,代替空间金字塔池化结构,获取更多细节特征。实验表明,在本文构建的行人数据集上,改进后的 YOLOv4算法的平均精度(average precision,AP)达到了90.08%,相比原YOLOv4算法提高了7.2%,对数平均漏检率(log-average miss rate,LAMR)降低了13.69%。
摘要:学术论文推荐旨在为用户提供个性化的论文资源,针对协同过滤方法面临数据高度稀疏和缺乏负样本的问题,提出了一种融合细粒度语义特征的学术论文对抗推荐模型——TAGAN(title and abstract GAN)。首先,基于具有语义特征的标题和摘要,使用卷积神经网络(CNN)提取标题的全局特征,并构建一个双层的长短期记忆(LSTM)网络分别对摘要的单词序列和语句序列建模,同时,引入注意力机制将标题和摘要进行语义上的关联。然后,将论文的语义特征融入基于生成对抗网络(GAN)的推荐框架中并进行训练,其生成模型会拟合用户的兴趣偏好,能有效替代负采样过程。最后,通过在公开数据集上的实验对比,TAGAN在各个指标上都优于基线模型,验证了TAGAN的有效性。