国内刊号:31-1289/TP
国际刊号:1000-3428
发布日期:
作者:沈勤丰, 黄璐瑶
单位:1. 东南大学网络空间安全学院, 江苏 南京 2111892. 江阴市华姿中等专业学校, 江苏 无锡 214401
关键词:连续学习,不确定性,校正,信息熵,知识蒸馏
连续学习是一种能在连续的数据流中训练模型的深度学习范式, 适合日益开放复杂的智能应用场景。连续学习最大的挑战是"灾难性遗忘", 即模型在学习新知识后会遗忘过去学习的知识。现有的连续学习忽视了不确定性对模型训练的影响, 且大多数方法都聚焦于连续学习后续阶段的改进, 对模型初始阶段研究较少。提出一种基于不确定性校正的可信连续学习方法, 通过在初始阶段约束模型输出的不确定性来弥补模型参数漂移带来的分类误差, 从而缓解"灾难性遗忘"。该方法可以与其他连续学习方法相结合并形成改进模型, 具有较强的通用性。对3种经典的连续学习方法进行改进, 实验结果表明所提方法均能有效提高原始模型的性能, 在2个数据集上平均分类准确率(ACA)提升1.2~19.1百分点。除此之外, 引入期望校准误差(ECE)评判连续学习模型的可靠性, 对比原始模型, 基于所提方法的改进模型具有更低的ECE, 这证明基于该方法的改进模型更加可信。
来源:2025年第12期
《计算机工程》期刊编辑部