1.一种分级分布式的边缘数据汇聚上报方法,其特征在于,包括:边缘网络处理任务时,将数据汇聚过程分成 个阶段,构建每个阶段的分级分布式的边缘数据汇聚上报模型, 为大于1的整数;其中,数据汇聚过程的每个阶段包括多个集群,每个集群包括多个集群成员,集群成员是边缘数据中心 ,每个集群中选择一个边缘数据中心 作为当前集群的集群中心,根据选择的集群中心,划分集群成员,最终完成全部 的集群划分,存储在边缘数据中心 的数据转移到当前阶段的集群中心;
分级分布式的边缘数据汇聚上报模型包括当前阶段任务完成时间 模型和工作完成总时间 模型,其中,当前阶段任务完成时间 模型中定义第 阶段任务完成时间 模型如下:;
工作完成总时间 模型为:
;
其中, 表示在第 阶段中任务完成时间, 为在第 阶段、集群 中边缘数据中心 与其他边缘数据中心 之间的通信时间, 为第 阶段、集群 中边缘数据中心 的数据处理时间, 为数据在链路中的传输速率, 为第阶段、边缘数据中心 的数据量, 为第 阶段、边缘数据中心 传输数据到其他边缘数据中心 之间的网络可用带宽, 为第 阶段、边缘数据中心 传输数据到其他边缘数据中心 之间的链路距离, 为第 阶段、的可用计算资源, 为第 阶段中、除瓶颈集群外、剩余集群中最后完成汇聚任务的集群所花费的时间, 是一个从第2阶段开始一直到第 个阶段中、不断累加 与 之差后的值。
2.根据权利要求1所述的一种分级分布式的边缘数据汇聚上报方法,其特征在于,瓶颈集群是指最后一个完成数据汇聚任务的集群。
3.根据权利要求1所述的一种分级分布式的边缘数据汇聚上报方法,其特征在于,的构建过程如下:定义 等于第 阶段瓶颈集群所消耗的时间,瓶颈集群是指最后一个完成数据汇聚任务的集群;
为:
(1)其中, 为在第 阶段中、集群 完成数据汇聚的时间;
定义为:
(2) (3)
其中, 为第 阶段、边缘数据中心 传输数据到其他边缘数据中心时、 发送数据所需要的时间; 为第 阶段、边缘数据中心 传输数据到其他边缘数据中心 所需要的时间;
(4)其中, 为第 阶段、 的可用计算资源;
(5)。
4.根据权利要求1所述的一种分级分布式的边缘数据汇聚上报方法,其特征在于, (6)其中, 为每个阶段中 与 之差。
5.根据权利要求4所述的一种分级分布式的边缘数据汇聚上报方法,其特征在于,计算的方法如下:步骤1、当 时,初始化 ;
步骤2、如果第 阶段瓶颈集群中的边缘数据中心不是第 阶段的集群中心,则直接执行步骤3;
如果第 阶段瓶颈集群中的边缘数据中心依然为第 阶段的集群中心,则继续如下判断:如果该集群中心为第 阶段的瓶颈集群中心、且 ,更新第 阶段 ;
如果该集群中心为第 阶段的瓶颈集群中心、且 ,则 保持不变;
如果该集群中心不为第 阶段的瓶颈集群中心、且 ,则更新当前阶段 , ;
如果该集群中心不为第 阶段的瓶颈集群中心、且 ,则更新当前阶段 ;
步骤3、更新边缘数据中心在集群的数据汇聚时间为 ,并判断:如果 ,更新 ;
如果 ,更新 ;
如果 , 、 均保持不变;
步骤4、根据步骤2或步骤3得到 和 值,更新当前进入下一阶段的;
步骤5、 ,如果 ,返回步骤2;否则循环结束, 。
6.根据权利要求1所述的一种分级分布式的边缘数据汇聚上报方法,其特征在于,每个集群中选择一个边缘数据中心 作为当前集群的集群中心 ,根据选择的集群中心,划分集群成员,最终完成全部 的集群划分;具体如下:步骤①、选择初始集群中心;
考虑 之间的最短路径Pmin以及网络资源中的可用带宽 作为判定度量确定第阶段初始集群中心的选择;
第 阶段第 个 的判定度量 定义如下: (7)其中, 表示第 个边缘数据中心与其他边缘数据中心之间的平均最短路径距离的权重值; 表示第 个边缘数据中心与其他边缘数据中心之间的最大平均可用带宽;
对 定义两条约束:
约束1: ;
约束2: ;
其中, 为当前阶段 的数目;
根据约束1和约束2,设 ,则定义 : (8)其中, 为第 个边缘数据中心与其他边缘数据中心之间的平均最短路径距离之和,为第 个边缘数据中心与其他边缘数据中心之间的平均最短路径距离;
根据公式(8),得到最终的判定度量 公式为: (9)根据公式(9),选择 值最大的第 个边缘数据中心作为当前 阶段的初始集群中心;
步骤②、选择剩余集群中心;
定义集群中心 ,设需要划分集群的个数为 , ,则,即 为第 个集群中心;选择集群
中心之间的最短路径作为判定标准,完成剩余集群中心的选择;具体如下:当 时,选择 最大的 作为集群中心;
当 时,首先选择最大的 的 作为第一个集群中心 ,然后选择离 最远的 作为第二个集群中心 ;
当 时,假设已经选择 个集群中心, ,则在选取第 个集群中心时,距离当前 个集群中心最远的 作为第 个集群中心;
步骤③、划分集群;
当 时,则当前阶段只有一个集群,无需划分集群,其他剩余 均为初始集群中心的集群成员;
当 时,划分集群的方法如下:
步骤A、首先对初始集群中心与其他剩余 的Pmin进行升序排序,选择前 个作为初始集群中心的集群成员;
定义每个集群中分配的 的数目 区间为: (10)其中,N+表示除0外的自然数;
步骤B、然后,对 与其他未被划分集群的剩余 的 进行升序排序,选择前个 作为集群中心的集群成员;
步骤C、重复步骤B,直到完成第 ‑1个集群中心 的划分;最后,未被划分集群的剩余 划分为集群中心 的集群成员。
7.根据权利要求6所述的一种分级分布式的边缘数据汇聚上报方法,其特征在于,最大平均可用带宽为多个最大可用带宽的平均值,最大可用带宽为路径中可用带宽最小链路的值。
8.一种分级分布式的边缘数据汇聚上报装置,其特征在于,包括数据汇聚上报模块,数据汇聚上报模块,用于当边缘网络处理任务时,将数据汇聚过程分成 个阶段,构建每个阶段的分级分布式的边缘数据汇聚上报模型, 为大于1的整数;其中,数据汇聚过程的每个阶段包括多个集群,每个集群包括多个集群成员,集群成员是边缘数据中心 ,每个集群中选择一个边缘数据中心 作为当前集群的集群中心,根据选择的集群中心,划分集群成员,最终完成全部 的集群划分,存储在边缘数据中心 的数据转移到当前阶段的集群中心;
分级分布式的边缘数据汇聚上报模型包括当前阶段任务完成时间 模型和工作完成总时间 模型,其中,当前阶段任务完成时间 模型中定义第 阶段任务完成时间 模型如下:;
工作完成总时间 模型为:
;
其中, 表示在第 阶段中任务完成时间, 为在第 阶段、集群 中边缘数据中心 与其他边缘数据中心 之间的通信时间, 为第 阶段、集群 中边缘数据中心 的数据处理时间, 为数据在链路中的传输速率, 为第阶段、边缘数据中心 的数据量, 为第 阶段、边缘数据中心 传输数据到其他边缘数据中心 之间的网络可用带宽, 为第 阶段、边缘数据中心 传输数据到其他边缘数据中心 之间的链路距离, 为第 阶段、的可用计算资源, 为第 阶段中、除瓶颈集群外、剩余集群中最后完成汇聚任务的集群所花费的时间, 是一个从第2阶段开始一直到第 个阶段中、不断累加 与 之差后的值。
9.一种计算机设备,包括存储器、处理器,以及存储在所述存储器中并能够在所述处理器上运行的计算机程序,其特征在于,所述处理器执行所述计算机程序时实现如权利要求1至7任一项所述的分级分布式的边缘数据汇聚上报方法的步骤。
10.一种计算机可读存储介质,所述计算机可读存储介质存储有计算机程序,其特征在于,所述计算机程序被处理器执行时实现如权利要求1至7任一项所述的分级分布式的边缘数据汇聚上报方法的步骤。