京公网安备 11010802034615号
经营许可证编号:京B2-20210330
相关研究表现,44%的大型企业(即拥有超过1000名员工的企业)认为其安全数据收集和分析是“大数据”应用,而另外44%认为其安全数据收集和分析将会在未来2年内成为“大数据”应用。此外,86%的企业正在收集比两年前“更多”或“略多”的安全数据。
这种增长趋势非常明显,大型企业正在收集、处理和保存越来越多的数据用于分析,他们使用来自IBM、Lancope、LogRhythm、 Raytheon、RSA Security和Splunk等供应商的工具和服务从数据中获取可操作情报用于风险管理和事故预防/检测/响应。
最近,笔者与安全专家以及供应商围绕大数据安全分析进行了很多探讨,这些讨论往往专注于分析应用程序方面。有时候这些讨论会围绕于安全分析基础设施,例如Hadoop、HDFS、Pig和Mahout,有时候则围绕UI、可视化分析、应用程序整合等。
每个人都对大数据安全分析应用程序感兴趣,但几乎没有人会问大数据安全分析所需要的IT基础设施基础。其结果是,很多企业会受到打击,他们甚至无法收集他们想要分析的安全数据。
收集和处理千兆或兆兆字节的安全数据需要对大数据安全分析管道进行一些规划和部署,包括如下:
·数据包捕捉设备。这些设备包括来自Cavium、Emulex和Solarflare等供应商的高性能智能NIC卡,磁盘驱动器,以及来自 Wireshark等供应商的PCAP软件,它们整合在一起作为数据包捕捉设备。这些设备需要足够快以捕捉和处理数据包,用于分析引擎的分类。PCAP硬 件设备将出现在整个网络的关键连接点,而虚拟PCAP设备能够支持服务器虚拟化和云计算平台。
·分析分布网络。数据包捕捉设备收集和处理数据,但数据仍然需要接近实时地在多个分析引擎移动。这正是分析分布网络的工作,这种系统包括来自 Anue、Apcon、BitTap、Gigamon、Netscout和Riverbed等供应商的设备。在某些情况下,分析分布网络将补充数据包捕捉 设备,在其他情况下,分析分布网络将提供轻量级PCAP功能。(请注意,用来描述这个的行业术语是“网络数据包代理设备”,但笔者认为这太以设备为中心, 所以换了名称。)
·SDN。SDN可编程控制平面很可能会成为穷人的分析分布网络,但SDN不会很快就抢占分配网络设备的地位。SDN将会成为分析基础设施的一部分,补充PCAP和分析分布网络功能。SDN和分析分布网络整合给网络数据捕捉和分析引擎带来了强大的连接性。
·分析中间件。在很多情况下,每个分析工具收集、处理和路由其自己的数据。虽然这是可行的,但这带来了很大的冗余性、资本成本和运营开销。这里 需要的是某种类型的基于标准的中间件,以进行消息队列或发布和订阅。例如,RSA Security公司使用开源RabiitMQ作为其分析引擎之间的中间件。
从架构的角度来看,企业可以采用分层的方法来部署大数据安全分析,其中分析引擎从管道中抽象出来,但可以很容易地用来定制化安全数据收集、处理 和分布。这能让首席信息官、首席信息安全官和网络工程师来调整期基础设施、流程和分析引擎,满足其具体的企业和行业要求,以及管理资本和运营成本。
本文转载于企业网
数据分析咨询请扫描二维码
若不方便扫码,搜微信号:CDAshujufenxi
在Python开发中,HTTP请求是与外部服务交互的核心场景——调用第三方API、对接微服务、爬取数据等都离不开它。虽然requests库已 ...
2025-12-12在数据驱动决策中,“数据波动大不大”是高频问题——零售店长关心日销售额是否稳定,工厂管理者关注产品尺寸偏差是否可控,基金 ...
2025-12-12在CDA(Certified Data Analyst)数据分析师的能力矩阵中,数据查询语言(SQL)是贯穿工作全流程的“核心工具”。无论是从数据库 ...
2025-12-12很多小伙伴都在问CDA考试的问题,以下是结合 2025 年最新政策与行业动态更新的 CDA 数据分析师认证考试 Q&A,覆盖考试内容、报考 ...
2025-12-11在Excel数据可视化中,柱形图因直观展示数据差异的优势被广泛使用,而背景色设置绝非简单的“换颜色”——合理的背景色能突出核 ...
2025-12-11在科研实验、商业分析或医学研究中,我们常需要判断“两组数据的差异是真实存在,还是偶然波动”——比如“新降压药的效果是否优 ...
2025-12-11在CDA(Certified Data Analyst)数据分析师的工作体系中,数据库就像“数据仓库的核心骨架”——所有业务数据的存储、组织与提 ...
2025-12-11在神经网络模型搭建中,“最后一层是否添加激活函数”是新手常困惑的关键问题——有人照搬中间层的ReLU激活,导致回归任务输出异 ...
2025-12-05在机器学习落地过程中,“模型准确率高但不可解释”“面对数据噪声就失效”是两大核心痛点——金融风控模型若无法解释决策依据, ...
2025-12-05在CDA(Certified Data Analyst)数据分析师的能力模型中,“指标计算”是基础技能,而“指标体系搭建”则是区分新手与资深分析 ...
2025-12-05在回归分析的结果解读中,R方(决定系数)是衡量模型拟合效果的核心指标——它代表因变量的变异中能被自变量解释的比例,取值通 ...
2025-12-04在城市规划、物流配送、文旅分析等场景中,经纬度热力图是解读空间数据的核心工具——它能将零散的GPS坐标(如外卖订单地址、景 ...
2025-12-04在CDA(Certified Data Analyst)数据分析师的指标体系中,“通用指标”与“场景指标”并非相互割裂的两个部分,而是支撑业务分 ...
2025-12-04每到“双十一”,电商平台的销售额会迎来爆发式增长;每逢冬季,北方的天然气消耗量会显著上升;每月的10号左右,工资发放会带动 ...
2025-12-03随着数字化转型的深入,企业面临的数据量呈指数级增长——电商的用户行为日志、物联网的传感器数据、社交平台的图文视频等,这些 ...
2025-12-03在CDA(Certified Data Analyst)数据分析师的工作体系中,“指标”是贯穿始终的核心载体——从“销售额环比增长15%”的业务结论 ...
2025-12-03在神经网络训练中,损失函数的数值变化常被视为模型训练效果的“核心仪表盘”——初学者盯着屏幕上不断下降的损失值满心欢喜,却 ...
2025-12-02在CDA(Certified Data Analyst)数据分析师的日常工作中,“用部分数据推断整体情况”是高频需求——从10万条订单样本中判断全 ...
2025-12-02在数据预处理的纲量统一环节,标准化是消除量纲影响的核心手段——它将不同量级的特征(如“用户年龄”“消费金额”)转化为同一 ...
2025-12-02在数据驱动决策成为企业核心竞争力的今天,A/B测试已从“可选优化工具”升级为“必选验证体系”。它通过控制变量法构建“平行实 ...
2025-12-01