京公网安备 11010802034615号
经营许可证编号:京B2-20210330
中移动掘金大数据 浪潮为其改造基础架构
海量数据是4G时代送给电信运营商最大的礼物。信息、互联网行为数据、话单数据、WAP日志/WEB日志、互联网网页、投诉文本、短信文本等结构化数据以及非结构数据呈现几何式增长,基于这些数据的挖掘、共享、分析已经成为全球电信运营商转变商业模式的重要资源,目前,全球120家运营商中,已经有48%的企业正在实施大数据战略。
某省移动公司是全省唯一专注移动通信领域的电信运营企业,网络容量1400万户,客户总量超过6000万户。作为“中国移动通信”网络的有机组成部分,该移动公司一直专注于新技术开发和应用,并在大数据平台的建设中走在了最前沿。
要用大数据 先改变基础架构
现阶段,三大运营商还处于数据应用的初级阶段只支持流量经营、智能管道等应用,主要采用基于内部整合数据的分析挖掘手段,未能形成规模并进行商业利用。而旧有系统建设分散,无法实现资源应用共享。数据的分散存储和传统架构的缺陷,无法满足新业务发展要求。
目前国内的三大运营商都在着力整合企业内外部数据,做到内部交易数据与互联网交互数据的融合,由此开展用户行为模式的分析与数据挖掘并支撑各类数据应用,包括:支持精细化营销、支持产品规划和创新、支持网络优化和投资、支持能力开放与合作。长远来看,运营商应建立基于大数据驱动,以消费者为中心、以客户体验为重心的企业运营及组织变革模式,如淘宝将数据化运营贯穿业务全过程,以选品、价格和推送作为淘宝客户体验的三个灵魂。
而现实的IT基础架构则阻碍了电信行业发展大数据的步伐。首先,传统IT系统建设分散,很难实现资源和应用共享。诸如经营分析、信令监测、综合网络分析、不良信息监测以及上网日志留存等大数据系统垂直建设较多,同时,系统建设存在重复建设、应用重复开发、各类专家资源无法共享等情况。
其次,数据分散存储,标准化程度低。要对网络流量大数据进行分析,必须实现数据的集中存储,并有统一的标准。但从目前来看,各大运营商数据系统的数据模型并未统一,跨系统综合分析较为困难,在原有基础之上实现统一管理的难度较高。
最后,以联机事务处理系统On-Line Transaction Processing (OLTP)为核心的传统架构难以满足新业务发展要求,海量的大数据处理需要高度易扩展、高性能的基础架构,先行架构在存储、计算等各个方面都不能满足需求。
架构改变是基础 整体效率是目标
为了推进全网数据流量的精细化经营,提升数据流量经营效益,尤其是挖掘数据价值,开拓新的业务内容和盈利项目,某省移动与浪潮合作搭建大数据平台,建成后该平台用于多个平台数据分析业务。平台会处理每月客户账单,确保每月1日按时为用户提供账单服务,河南移动每年数据符合增长率在15%左右,基础架构完全可以满足扩容的技术需求。
由50台浪潮双路服务器NF5270M3构建Hadoop平台是系统的核心,另外三十台NF5270M3构建数据库处理平台。
网络——容错,高性能
系统采用了全新的IP网络互联架构,有足够的容错能力和性能来支持规模化数据处理。这一设计方案的优点是每台服务器配置两个10GB端口,端口通过冗余绑定方式分别与两台不同的汇聚交换机相连。此外通过高度冗余的三台二层交换机将所有汇聚交换机连接为统一的子网,最大限度的提高系统的冗余度和节点间通信带宽限制。
存储——成本降20%,效率提高3倍
数据存储方案也采用了分布式本地存储方式,采用双路服务器构建,替代原有的MNC小型机加磁盘阵列的方式,建设成本降低了20%以上。新平台可实现海量图片、视频文件的快速存储与查询,数据处理效率提升50%以上。而且,浪潮根据该省移动数据具体需求对大数据系统做了深层次的优化,在存储和网络资源间更均匀地平衡负载,从而将资源利用率提高三倍多。
电信行业的大数据仍然刚刚起步
该移动完成大数据平台建设后,不仅可以为相关企业提供数据分析报告,增加新的企业赢利点,而且可以通过对用户位置信息和指令信息的历史数据和当前信息分析建模,服务公共服务业,指挥交通、应对突发事件和重大活动。
此外还可以对某个时段和某个地点的用户流量和关键影响因素进行分析,洞察结果可为零售商在新店设计和选址、商品促销方式等提供决策支撑,从而帮助零售商更好地洞察客户需求,提升营销业绩。
2014年大数据的普及和运用都达到了前所未有的高度,但仍然仅是一个起步。凭借数据分析来竞争,实现数据价值货币化,这是运营商的终极追求。当一个人拿着手机玩《刀塔传奇》时,用快的软件叫一辆出租车时,无形的数据已经形成了一个流通的气场,这个气场就需要运营山的大数据平台来支持,从这个角度看,运营商的大数据建设还有更远的路要走。
此次同该移动合作的浪潮是中国领先的云计算和大数据方案供应商,也是2014年唯一全面入围三大电信运营商的服务器品牌厂商,在运营商集采中占有30%的份额。
数据分析咨询请扫描二维码
若不方便扫码,搜微信号:CDAshujufenxi
【核心关键词】贷款、报表、课程、专业、建模、缺失值、营销、互联网、银行、办公自动化、数据分析、数据预处理、特征工程、贷 ...
2026-06-05在数据库数据查询、业务报表统计、多表关联分析中,LEFT JOIN左连接是使用率最高的SQL关联查询语句。其核心特性是保留左表全部数 ...
2026-06-05 很多数据分析师能熟练地写SQL、做透视表、算描述性统计,但当被问到“如何预测用户流失概率”“如何归因销量下滑的关键因素 ...
2026-06-05任何一款产品从诞生、普及到最终退出市场,都会遵循一套固定的发展规律,这就是产品生命周期理论。在市场竞争日益激烈、产品迭代 ...
2026-06-04在Excel数据分析、办公统计、业务报表制作场景中,数据透视表是数据汇总、分类统计、快速复盘的核心工具,能够高效完成海量原始 ...
2026-06-04 很多数据分析师拿到数据就开始清洗、建模,但当被问到“这批数据属于什么类型——结构化还是非结构化?分类变量还是数值变量 ...
2026-06-04在问卷调查与社会科学数据分析中,卡方检验是最常用、最基础的非参数检验方法,广泛应用于市场调研、用户分析、行为统计、满意度 ...
2026-06-03【核心关键词】贷款、报表、课程、专业、建模、缺失值、营销、互联网、银行、办公自动化、数据分析、数据预处理、特征工程、贷 ...
2026-06-03 很多数据分析师画过趋势图、做过业绩预测,但当被问到“这个月销售额增长20%,到底是长期趋势自然增长,还是促销活动的短期 ...
2026-06-03逻辑回归是数据分析、机器学习、统计建模中应用最广泛的二分类预测模型,常用于风险判断、行为预测、归因分析等场景。在SPSS、Py ...
2026-06-02数字经济时代,市场竞争日趋同质化,用户消费需求愈发个性化、多元化,传统依托经验、粗放式、广撒网的营销模式弊端日益凸显。长 ...
2026-06-02 很多数据分析师做过按月份的销售额趋势图,画过按天的流量折线图,但当被问到“时间序列和普通数据有什么本质区别”“季节性 ...
2026-06-02在市场竞争日趋饱和、用户需求不断细分的当下,企业创业创新、产品迭代与市场拓展不再依赖经验决策,而是需要系统化、工具化的商 ...
2026-06-01【核心关键词】调度、岗位、数据库、企业、报表、培训、程序、数据分析、数据加工、业务部门、企业数据、调度工具、业务指标、 ...
2026-06-01 很多数据分析师能熟练地计算指标、搭建标签体系,但当被问到“画像到底在解决什么问题”“画像和标签是什么关系”“画像如何 ...
2026-06-01在数据统计分析、数据清洗、异常值识别与数据分布研究中,箱型图是最直观、高效、专业的可视化分析工具。相较于柱状图、折线图仅 ...
2026-05-29Tkinter是Python内置的标准GUI图形界面库,具备无需额外安装、调用简单、兼容性强、轻量化高效等优势,是Python快速开发桌面小程 ...
2026-05-29 很多分析师在设计标签时思路清晰,但真到落地环节却面临“数据在手,不知如何转化为可用标签”的困境:或因加工方式选择不当 ...
2026-05-29【核心关键词】大数据、经理、专业、金融、客户、传统、建模、数据产品、互联网金融、产品经理、数据分析、金融行业、数据模型 ...
2026-05-28 很多分析师每天和数据打交道,但当被问到“标签是什么”“标签和指标有什么区别”“标签体系如何设计”时,却常常答不上来。 ...
2026-05-28