互联网与媒体行业某央媒机构

某央媒机构全球分社网络保障案例

本部数据中心与国内、国际分社信息交互频繁,需要保障重大事件期间链路与应用稳定。

链路质量分析故障定位历史回溯运行保障
业务访问链路从访问到定位的完整证据链
  1. 01用户访问请求与会话
  2. 02网络链路流量与质量
  3. 03业务应用异常线索
  4. 04后端服务定位与回溯

智能全流量分析回溯 · 业务链路示意

01

业务环境

项目背景

经过持续发展,该机构已拥有数十家分社和多家分支机构,用户遍布全球 200 多个国家和地区。机构本部数据中心与国内、国际分社的信息交互日益频繁;重大信息交互期间,数据中心与分社之间的网络用量、链路质量和应用性能稳定性尤为重要。

02

需要解决的问题

用户痛点

需要对国内、国际分社链路进行 7×24 小时的用量、通信质量和连接状态监控;对国际链路进行端到端通断检测,在链路异常或主备切换时主动告警并提示故障节点;用户流量数据需要可追溯、可分析;重大事件期间还要快速定制监控界面,并提供高精度实时监控、告警和分析。

01

国际链路需要端到端通断检测

02

主备线路状态难区分

03

重大事件期间需要高精度监控

03

围绕真实业务建设

建设内容

01

国内与国际分社链路监控

02

核心系统访问慢分析

03

主动拨测结合 NetFlow

04

重大事件保障

05

数据报告

06

告警联动

业务问题数据接入异常发现定位回溯
04

来自案例集的实际界面与描述

应用场景

某央媒机构应用场景原图,摘自案例集第 36 页
案例集第 36 页 · 场景原图 1
某央媒机构应用场景原图,摘自案例集第 36 页
案例集第 36 页 · 场景原图 2
某央媒机构应用场景原图,摘自案例集第 37 页
案例集第 37 页 · 场景原图
  1. 01

    数据可视化

    在两地数据中心的互联网区、核心区等关键区域部署数据采集设备,并用集中管理器统一设计和管理;移动通信车部署移动终端设备,用于重大事件移动保障。互联网区监控视图全面呈现各链路的流入流出吞吐量、丢包率、建连成功率和变化趋势,可对比不同运营商线路的抖动、流量下滑和丢包情况。针对核心业务定制端到端视图,从用户接入区、核心区、互联网区三个区域监控,故障时快速定位网络区域,并观察出口流量下降或服务侧丢包上升等现象。

  2. 02

    核心系统访问慢

    通过多项指标分析评估模板,快速判断故障属于网络、应用还是主机性能问题。案例中用户数量、流量、丢包和网络连接在故障时间点无明显突增,但应用性能在 9—11 点明显上升,由此缩小问题范围。

  3. 03

    主备线路识别

    针对国际分社到总部的专线,仅依靠总部镜像流量无法检验链路实时状态,因此采用主动拨测结合 NetFlow 的方式监控分社链路。拨测视图实时呈现链路通断、质量和丢包状态,并关联 NetFlow 数据查看流入流出吞吐量与最高吞吐 IP 通信对;链路切换时用户可快速感知并响应。

  4. 04

    重大事件保障

    在国家 70 周年国庆期间,该机构向海内外播发多种形式报道累计上万条。智维数据提供技术支持和后方现场保障,持续监控移动报道网络平台,保障流量监控系统稳定运行。

  5. 05

    数据报告

    定制链路详情日报、周报、月报和一次性报表,用户可按部门需求选择相应报告模板。

  6. 06

    告警联动

    基于指标历史数据学习并预测未来数据区间,用于智能告警。告警触发后,智能全流量分析回溯将信息推送至第三方平台,再由第三方平台通知相关部门人员。

05

从数据到判断

分析过程

  1. 01

    持续监测分社链路用量、质量与连接状态

  2. 02

    结合主动拨测和 NetFlow 判断线路状态

  3. 03

    对接第三方平台推送告警

06

基于案例材料整理

应用价值

01

支持主备线路切换感知与故障节点判断

02

为重大事件提供持续监控

03

形成日报、周报、月报等数据报告

查看原始案例材料

对应案例集第 35–37 页,保留原始章节与图表。

下载案例集