
中移动掘金大数据 浪潮为其改造基础架构
海量数据是4G时代送给电信运营商最大的礼物。信息、互联网行为数据、话单数据、WAP日志/WEB日志、互联网网页、投诉文本、短信文本等结构化数据以及非结构数据呈现几何式增长,基于这些数据的挖掘、共享、分析已经成为全球电信运营商转变商业模式的重要资源,目前,全球120家运营商中,已经有48%的企业正在实施大数据战略。
某省移动公司是全省唯一专注移动通信领域的电信运营企业,网络容量1400万户,客户总量超过6000万户。作为“中国移动通信”网络的有机组成部分,该移动公司一直专注于新技术开发和应用,并在大数据平台的建设中走在了最前沿。
要用大数据 先改变基础架构
现阶段,三大运营商还处于数据应用的初级阶段只支持流量经营、智能管道等应用,主要采用基于内部整合数据的分析挖掘手段,未能形成规模并进行商业利用。而旧有系统建设分散,无法实现资源应用共享。数据的分散存储和传统架构的缺陷,无法满足新业务发展要求。
目前国内的三大运营商都在着力整合企业内外部数据,做到内部交易数据与互联网交互数据的融合,由此开展用户行为模式的分析与数据挖掘并支撑各类数据应用,包括:支持精细化营销、支持产品规划和创新、支持网络优化和投资、支持能力开放与合作。长远来看,运营商应建立基于大数据驱动,以消费者为中心、以客户体验为重心的企业运营及组织变革模式,如淘宝将数据化运营贯穿业务全过程,以选品、价格和推送作为淘宝客户体验的三个灵魂。
而现实的IT基础架构则阻碍了电信行业发展大数据的步伐。首先,传统IT系统建设分散,很难实现资源和应用共享。诸如经营分析、信令监测、综合网络分析、不良信息监测以及上网日志留存等大数据系统垂直建设较多,同时,系统建设存在重复建设、应用重复开发、各类专家资源无法共享等情况。
其次,数据分散存储,标准化程度低。要对网络流量大数据进行分析,必须实现数据的集中存储,并有统一的标准。但从目前来看,各大运营商数据系统的数据模型并未统一,跨系统综合分析较为困难,在原有基础之上实现统一管理的难度较高。
最后,以联机事务处理系统On-Line Transaction Processing (OLTP)为核心的传统架构难以满足新业务发展要求,海量的大数据处理需要高度易扩展、高性能的基础架构,先行架构在存储、计算等各个方面都不能满足需求。
架构改变是基础 整体效率是目标
为了推进全网数据流量的精细化经营,提升数据流量经营效益,尤其是挖掘数据价值,开拓新的业务内容和盈利项目,某省移动与浪潮合作搭建大数据平台,建成后该平台用于多个平台数据分析业务。平台会处理每月客户账单,确保每月1日按时为用户提供账单服务,河南移动每年数据符合增长率在15%左右,基础架构完全可以满足扩容的技术需求。
由50台浪潮双路服务器NF5270M3构建Hadoop平台是系统的核心,另外三十台NF5270M3构建数据库处理平台。
网络——容错,高性能
系统采用了全新的IP网络互联架构,有足够的容错能力和性能来支持规模化数据处理。这一设计方案的优点是每台服务器配置两个10GB端口,端口通过冗余绑定方式分别与两台不同的汇聚交换机相连。此外通过高度冗余的三台二层交换机将所有汇聚交换机连接为统一的子网,最大限度的提高系统的冗余度和节点间通信带宽限制。
存储——成本降20%,效率提高3倍
数据存储方案也采用了分布式本地存储方式,采用双路服务器构建,替代原有的MNC小型机加磁盘阵列的方式,建设成本降低了20%以上。新平台可实现海量图片、视频文件的快速存储与查询,数据处理效率提升50%以上。而且,浪潮根据该省移动数据具体需求对大数据系统做了深层次的优化,在存储和网络资源间更均匀地平衡负载,从而将资源利用率提高三倍多。
电信行业的大数据仍然刚刚起步
该移动完成大数据平台建设后,不仅可以为相关企业提供数据分析报告,增加新的企业赢利点,而且可以通过对用户位置信息和指令信息的历史数据和当前信息分析建模,服务公共服务业,指挥交通、应对突发事件和重大活动。
此外还可以对某个时段和某个地点的用户流量和关键影响因素进行分析,洞察结果可为零售商在新店设计和选址、商品促销方式等提供决策支撑,从而帮助零售商更好地洞察客户需求,提升营销业绩。
2014年大数据的普及和运用都达到了前所未有的高度,但仍然仅是一个起步。凭借数据分析来竞争,实现数据价值货币化,这是运营商的终极追求。当一个人拿着手机玩《刀塔传奇》时,用快的软件叫一辆出租车时,无形的数据已经形成了一个流通的气场,这个气场就需要运营山的大数据平台来支持,从这个角度看,运营商的大数据建设还有更远的路要走。
此次同该移动合作的浪潮是中国领先的云计算和大数据方案供应商,也是2014年唯一全面入围三大电信运营商的服务器品牌厂商,在运营商集采中占有30%的份额。
数据分析咨询请扫描二维码
若不方便扫码,搜微信号:CDAshujufenxi
Python HTTP 请求工具对比:urllib.request 与 requests 的核心差异与选择指南 在 Python 处理 HTTP 请求(如接口调用、数据爬取 ...
2025-09-12解决 pd.read_csv 读取长浮点数据的科学计数法问题 为帮助 Python 数据从业者解决pd.read_csv读取长浮点数据时的科学计数法问题 ...
2025-09-12CDA 数据分析师:业务数据分析步骤的落地者与价值优化者 业务数据分析是企业解决日常运营问题、提升执行效率的核心手段,其价值 ...
2025-09-12用 SQL 验证业务逻辑:从规则拆解到数据把关的实战指南 在业务系统落地过程中,“业务逻辑” 是连接 “需求设计” 与 “用户体验 ...
2025-09-11塔吉特百货孕妇营销案例:数据驱动下的精准零售革命与启示 在零售行业 “流量红利见顶” 的当下,精准营销成为企业突围的核心方 ...
2025-09-11CDA 数据分析师与战略 / 业务数据分析:概念辨析与协同价值 在数据驱动决策的体系中,“战略数据分析”“业务数据分析” 是企业 ...
2025-09-11Excel 数据聚类分析:从操作实践到业务价值挖掘 在数据分析场景中,聚类分析作为 “无监督分组” 的核心工具,能从杂乱数据中挖 ...
2025-09-10统计模型的核心目的:从数据解读到决策支撑的价值导向 统计模型作为数据分析的核心工具,并非简单的 “公式堆砌”,而是围绕特定 ...
2025-09-10CDA 数据分析师:商业数据分析实践的落地者与价值创造者 商业数据分析的价值,最终要在 “实践” 中体现 —— 脱离业务场景的分 ...
2025-09-10机器学习解决实际问题的核心关键:从业务到落地的全流程解析 在人工智能技术落地的浪潮中,机器学习作为核心工具,已广泛应用于 ...
2025-09-09SPSS 编码状态区域中 Unicode 的功能与价值解析 在 SPSS(Statistical Product and Service Solutions,统计产品与服务解决方案 ...
2025-09-09CDA 数据分析师:驾驭商业数据分析流程的核心力量 在商业决策从 “经验驱动” 向 “数据驱动” 转型的过程中,商业数据分析总体 ...
2025-09-09R 语言:数据科学与科研领域的核心工具及优势解析 一、引言 在数据驱动决策的时代,无论是科研人员验证实验假设(如前文中的 T ...
2025-09-08T 检验在假设检验中的应用与实践 一、引言 在科研数据分析、医学实验验证、经济指标对比等领域,常常需要判断 “样本间的差异是 ...
2025-09-08在商业竞争日益激烈的当下,“用数据说话” 已从企业的 “加分项” 变为 “生存必需”。然而,零散的数据分析无法持续为业务赋能 ...
2025-09-08随机森林算法的核心特点:原理、优势与应用解析 在机器学习领域,随机森林(Random Forest)作为集成学习(Ensemble Learning) ...
2025-09-05Excel 区域名定义:从基础到进阶的高效应用指南 在 Excel 数据处理中,频繁引用单元格区域(如A2:A100、B3:D20)不仅容易出错, ...
2025-09-05CDA 数据分析师:以六大分析方法构建数据驱动业务的核心能力 在数据驱动决策成为企业共识的当下,CDA(Certified Data Analyst) ...
2025-09-05SQL 日期截取:从基础方法到业务实战的全维度解析 在数据处理与业务分析中,日期数据是连接 “业务行为” 与 “时间维度” 的核 ...
2025-09-04在卷积神经网络(CNN)的发展历程中,解决 “梯度消失”“特征复用不足”“模型参数冗余” 一直是核心命题。2017 年提出的密集连 ...
2025-09-04