国内刊号:31-1289/TP
国际刊号:1000-3428
发布日期:
作者:陆怡, 王鹏, 汪卫
单位:1. 复旦大学 软件学院, 上海 201203;2. 复旦大学 计算机科学技术学院, 上海 201203
关键词:时间序列,语义挖掘,相似性度量,聚类,k最近邻
基金:国家重点研发计划(2020YFB1710001)。
时间序列是对某个事物或系统进行连续同间隔测量得到的数值序列,挖掘时间序列中潜在的语义信息对于发现系统运行规律或识别系统突发异常至关重要,然而目前多数时间序列语义挖掘算法对于时间序列数据特征有一定的约束条件,难以处理海量且特征各异的时间序列数据。针对该问题,提出一种基于子序列相似性的时间序列语义挖掘算法。通过计算子序列的相似性,将时间序列分割成片段序列进行两级聚类,识别出时间序列中潜在的物理状态。引入基于概率的迭代模式,根据候选分段情况动态调整子序列被选为参考子序列的概率,保证参考子序列涵盖全部物理状态。实验结果表明,该算法在PAMAP、Barbet等5个真实数据集上的识别准确率均超过90%,相比于FLUSS、pHMM、AutoPlait算法具有更高的识别准确率与运行效率以及更强的通用性。
来源:2022年第10期
《计算机工程》期刊编辑部