国内刊号:31-1289/TP
国际刊号:1000-3428
发布日期:
作者:王兴杰, 王侃, 费蓉, 王怀军, 郭银波, 兰大鹏, 朱晓杰
单位:1. 西安理工大学计算机科学与工程学院, 陕西 西安 7100482. 无锡金云智联科技有限公司研发中心, 江苏 无锡 2140003. 奥斯陆大学信息科学系, 挪威 奥斯陆 03734. 阿卜杜拉国王科技大学计算机系, 沙特阿拉伯 吉达 23955-6900
关键词:空天地一体化网络,低轨道地球卫星,移动边缘计算,深度强化学习,生成扩散模型,计算卸载,资源分配
基金:国家自然科学基金(61801379); 国家自然科学基金(62076200); 陕西省自然科学基金(2023-YBGY-149); 国家自然科学基金国际合作与交流项目(62120106011); 陕西省自然科学基础研究计划(2022SF-353); 陕西省自然科学基础研究计划(2022QFY01-03); 西安市科技规划基金项目(2022JH-RYFW-0072)
通过协同管理地面网络、卫星网络和近地无人机网络等, 空天地一体化算力融合网络有望实现全域连接和普适智能, 为我国数字经济发展提供有力支撑。而低轨道地球(LEO)卫星具备泛在连接和边缘计算能力, 为实现空天地一体化的高效计算体系提供了基础。通过将移动边缘计算(MEC)沉降至LEO卫星网络, 形成面向业务的"端-边-云"三级计算架构, 可将时延敏感型业务从终端卸载到LEO卫星侧, 以提升该业务的任务完成率。然而, 为LEO卫星边缘网络制定高效计算卸载和算力分配决策是一个亟待解决的问题。针对高动态性的卫星网络环境和离散-连续的混合动作空间, 提出一种基于生成扩散模型的混合近端策略优化(H-PPO)方法。首先, 对具有时变特性的无线信道进行建模, 并构建不同卸载决策下的服务时延、通信和计算模型。其次, 在卸载决策、剩余计算资源和功率控制的多约束条件下, 构建最大化平均任务完成率的长期优化问题。然后, 建立具有参数化动作的马尔可夫决策过程模型, 将生成扩散模型引入为离散动作策略, 增强传统深度强化学习(DRL)方法的采样效率和探索能力, 并利用所提算法联合优化计算卸载、算力分配和功率控制变量。仿真结果表明, 所提算法具有较好收敛性能, 并在任务完成率方面优于其他3种对比方法。
来源:2026年第1期
《计算机工程》期刊编辑部