CN104243232A

Virtual network fault detection and location method

Abstract

The present invention relates to a method for detecting and locating virtual network faults, which includes the following steps: 1. Establish a virtual network fault management system in which the fault management center periodically sends status query requests to the physical nodes managed by it; 2: physical nodes Perform health checks on nodes and related link resources through its own detection mechanism, and send resource status information to the fault management center; 3: The fault management center determines whether an abnormality occurs in the virtual network based on the received information, and if an abnormality occurs, execute it 4. Otherwise, end; 4: The fault management center sends an abnormal query request to the associated nodes at both ends of the abnormal link in the switch; 5: The associated node sends an abnormal query response message to the fault management center according to the query content, and the fault management center confirms according to the message The exact location and type of the fault. The invention can automatically, quickly and accurately detect and locate the fault of the virtual network.

Term

No projected expiry on record.

  1. Priority and filed
  2. Published
  3. Today

6 claims: 1 independent, 5 dependent

  1. 1
    一种虚拟网故障探测和定位方法,其特征是:含有下列步骤: 步骤I :建立一个虚拟网故障管理系统,该虚拟网故障管理系统含有故障管理中心和 基础支撑环境中的物理节点,故障管理中心用于进行网络资源监控和故障发现与定位;基 础支撑环境中的物理节点用于为虚拟网构建提供基础资源;故障是指用于构建虚拟网的资 源发生异常,无法为虚拟网构建及其上运行的各类业务提供网络服务; 步骤2 :故障管理中心周期性向其管理的物理节点发送状态查询请求; 步骤3 :收到查询请求的物理节点通过自身的检测机制对节点和相关链路资源进行健 康检查; 步骤4:各物理节点通过故障管理接口向故障管理中心发送资源状态信息,根据查询 内容及健康检查的结果进行通告; 步骤5 :故障管理中心根据收到的资源状态信息判定虚拟网中是否发生异常,如发生 异常,则执行步骤6,否则,执行步骤9 ; 步骤6 :当虚拟网中发生异常时,物理节点会探测到某交换中的异常链路,故障管理中 心通过向该异常链路两端的关联节点发送异常查询请求消息来确认故障的准确位置和类 型;由于异常链路连接两个关联节点,因此至少需要向这两个关联节点都发送异常查询请 求消息;请求查询的内容含有:分享该异常链路资源的所有虚拟网中该异常链路的状态; 步骤7 :收到异常查询请求消息的关联节点根据查询内容向故障管理中心发送异常查 询应答消息; 步骤8 :故障管理中心根据异常查询应答消息确认故障的准确位置和类型; 步骤9 :结束。
  2. 2
    根据权利要求1所述的虚拟网故障探测和定位方法,其特征是:所述故障含有物理 节点故障、物理链路故障、虚拟节点故障和虚拟链路故障。
  3. 3
    根据权利要求1所述的虚拟网故障探测和定位方法,其特征是:所述故障管理中心 进行下列工作:监控各虚拟网中的资源运行状态;及时更新基础支撑环境中可用资源分布 情况;对虚拟网中发生的故障进行迅速精确定位;利用可用资源对故障进行修复处理。
  4. 4
    根据权利要求1所述的虚拟网故障探测和定位方法,其特征是:所述步骤2中,故障 管理中心向物理节点发送的状态查询内容含有:物理节点的资源总量、物理节点资源被分 配和映射到的虚拟网、各个虚拟网中分配的资源数量、剩余未分配的物理节点资源数量 、分配和映射给各个虚拟网的资源运行状态是否正常。
  5. 5
    根据权利要求1所述的虚拟网故障探测和定位方法,其特征是:所述步骤5中,判定 虚拟网中发生异常的方法如下: 方法1 :如果故障管理中心在限定时间内未收到针对某物理节点的状态查询请求的回 复信息,或物理节点的回复信息与故障管理中心预测的资源状态信息不符,则判定虚拟网 中发生异常; 方法2 :如果故障管理中心收到物理节点发出的未请求的异常状态通告消息,则判定 虚拟网中发生异常。
  6. 6
    根据权利要求5所述的虚拟网故障探测和定位方法,其特征是:所述方法2中,物理 节点在发现异常情况时主动向故障管理中心通告异常状态通告消息,异常情况含有以下类 型: 类型1 :与物理节点连接的物理链路故障:发生该物理链路故障时,分享该物理链路资 源的各虚拟网都会探测到同样的异常情况,但是由于探测到异常情况的时间有先后,因此, 异常状态通告消息中只通告其中一个虚拟网的链路异常; 类型2 :虚拟链路故障:由于上层软件漏洞造成某虚拟网中的虚拟链路故障,则只有该 虚拟网会探测到链路异常; 类型3 :物理节点故障:如果是物理节点故障,则分享该物理节点资源的虚拟网都会探 测到异常,但是由于探测时间的关系,所以故障管理中心收到的异常通告只是其中的一个 虚拟网异常; 类型4 :虚拟节点故障:如果是上层软件漏洞的问题引起某虚拟网中的虚拟节点故障, 则只有该虚拟网会通告异常。 7.根据权利要求1所述的虚拟网故障探测和定位方法,其特征是:所述步骤8中,确认 故障的准确位置时,有以下情况: 情况1 :对于两个关联节点中的任一个关联节点,如果指定时间内故障管理中心未收 到该关联节点的任何应答消息,则判断该关联节点发生物理故障,与该关联节点物理相邻 的节点都会探测到与该关联节点相连的链路故障,向该关联节点的所有物理邻接节点都发 送异常查询请求消息,从而更准确地定位故障; 情况2:如果两个关联节点都有应答消息,且其中第一个关联节点的应答消息中通告 了处于该虚拟网中的所述异常链路,而第二个关联节点由于配置故障已经释放了分配给该 虚拟网中相应的资源,因此,第二个关联节点的应答消息中没有所述异常链路在虚拟网中 的资源状态,该资源状态在第一个关联节点的异常通告消息中通告过,这说明第二个关联 节点映射到该虚拟网的虚拟节点发生故障; 情况3 :如果在两个关联节点的应答消息中,分享所述异常链路资源的所有虚拟网都 通告该异常链路异常,则说明:为该异常链路提供基础资源的物理链路故障,该物理链路资 源都变为不可用状态; 情况4:如果在两个关联节点的应答消息中,都只是通告某虚拟网中的所述异常链路 异常,则说明:只是该异常链路映射到该虚拟网中的虚拟链路故障。
Independent claims6