
当冷存储遇到大数据:在私有云中运行低成本分析
冷存储是不经常访问但却是必需数据的术语。人们需要了解冷存储如何工作,以及如何帮助大数据。已经有一些企业侧重于分层存储算法,其基于数据需要被访问的频率,将数据路由到最合适的存储介质,特别注意第一层,数据需要快速和频繁的最快速的访问存储恢复器。
但是在“数据副本”中,高达85%的企业数据驻留在很少被访问的存储介质中,同时也存在一个迫在眉睫的危机,即如何以最低成本优化管理和维护这些数据,以及适当的数据存储,检索,安全和访问策略。
这种不常访问但仍然必要的数据的名称是“冷存储”。确定数据是“热”(经常访问),“暖”(适度访问)还是“冷”(不常访问)通常是存储管理员的工作,评估各种类别的数据访问。在某些情况下,数据中心甚至开始使用自动化存储分层软件来做出这些数据存储决策。
大数据因素进入讨论,因为有这么多的。为了治理的目的(即使不定期使用数据也需要保留数据),业务连续性(大数据和“常规”数据需要多个数据存储库,并用于灾难恢复故障转移)因为需要知道一切是什么,网站必须寻找低成本,缓慢的冷存储解决方案,所以他们可以承受这些必须保存但很少被访问的数据管理的成本。
适用于私有云环境的冷却数据服务提供商Storiant公司创始人兼首席执行官杰夫•福罗尔斯表示:“当我们研究存储市场时,我们认识到需要大容量冷存储,并且看到组织所有大数据流正在积累,这是一个日益严重的问题。”
福罗尔斯表示,他们可以在防火墙后安全保留数据,每月每GB每月只需0.01美元。亚马逊公司等大型公共云服务提供商也提供冷存储服务,但区别在于Storiant公司将其提供给用于企业的私有企业云;这吸引了许多企业使用公共云服务来提供他们的数据。
冷存储如何工作,以及如何帮助大数据
“大数据来自大的数据块,大数据分析经常需要处理大数据量的大数据对象。”福罗尔斯说。“使用冷存储,可以将一个存储大量数据的数据湖通过Hadoop计算节点扫描。”
像Storiant公司提供这样的解决方案可以容纳大型数据对象,这些数据对象包含表征最大数据的非结构化数据,以及日益包含大数据的物联网(IoT)数据(如网站日志文件)。当企业IT使用冷存储解决方案,并决定哪些存储容器要将大数据的特定块(或对象)分类到哪个存储容器时,企业可以对所有这些数据进行分类。在同一时间,可以分配给建立在容器中访问数据的每个容器的权限。
福罗尔斯表示,互联网服务提供商正在迅速实施这种风格的基于云计算的冷存储来存储大数据,因为它是弹性的,其能力可以满足扩展或收缩的需要。基于云计算的冷存储还具有财务灵活性,因为它消除了长期摊销数据中心资本支出(CAPEX)的需要,有利于更灵活地转换为资本性支出(OPEX)的冷存储方法,企业可以在短期内控制。
他说,“我们相信物联网将继续得到指数性增长,企业将需要管理自世界各地数以百万计的设备和数据源供应大量的大数据量,金融机构,医药公司,以及政府需要大规模,低成本的大型数据冷存储,最终,企业必须找到一种方法来安全地运行,并进行低成本分析,而私有云设置中的冷存储服务提供了这些优点。”
数据分析咨询请扫描二维码
若不方便扫码,搜微信号:CDAshujufenxi
随机森林算法的核心特点:原理、优势与应用解析 在机器学习领域,随机森林(Random Forest)作为集成学习(Ensemble Learning) ...
2025-09-05Excel 区域名定义:从基础到进阶的高效应用指南 在 Excel 数据处理中,频繁引用单元格区域(如A2:A100、B3:D20)不仅容易出错, ...
2025-09-05CDA 数据分析师:以六大分析方法构建数据驱动业务的核心能力 在数据驱动决策成为企业共识的当下,CDA(Certified Data Analyst) ...
2025-09-05SQL 日期截取:从基础方法到业务实战的全维度解析 在数据处理与业务分析中,日期数据是连接 “业务行为” 与 “时间维度” 的核 ...
2025-09-04在卷积神经网络(CNN)的发展历程中,解决 “梯度消失”“特征复用不足”“模型参数冗余” 一直是核心命题。2017 年提出的密集连 ...
2025-09-04CDA 数据分析师:驾驭数据范式,释放数据价值 在数字化转型浪潮席卷全球的当下,数据已成为企业核心生产要素。而 CDA(Certified ...
2025-09-04K-Means 聚类:无监督学习中数据分群的核心算法 在数据分析领域,当我们面对海量无标签数据(如用户行为记录、商品属性数据、图 ...
2025-09-03特征值、特征向量与主成分:数据降维背后的线性代数逻辑 在机器学习、数据分析与信号处理领域,“降维” 是破解高维数据复杂性的 ...
2025-09-03CDA 数据分析师与数据分析:解锁数据价值的关键 在数字经济高速发展的今天,数据已成为企业核心资产与社会发展的重要驱动力。无 ...
2025-09-03解析 loss.backward ():深度学习中梯度汇总与同步的自动触发核心 在深度学习模型训练流程中,loss.backward()是连接 “前向计算 ...
2025-09-02要解答 “画 K-S 图时横轴是等距还是等频” 的问题,需先明确 K-S 图的核心用途(检验样本分布与理论分布的一致性),再结合横轴 ...
2025-09-02CDA 数据分析师:助力企业破解数据需求与数据分析需求难题 在数字化浪潮席卷全球的当下,数据已成为企业核心战略资产。无论是市 ...
2025-09-02Power BI 度量值实战:基于每月收入与税金占比计算累计税金分摊金额 在企业财务分析中,税金分摊是成本核算与利润统计的核心环节 ...
2025-09-01巧用 ALTER TABLE rent ADD INDEX:租房系统数据库性能优化实践 在租房管理系统中,rent表是核心业务表之一,通常存储租赁订单信 ...
2025-09-01CDA 数据分析师:企业数字化转型的核心引擎 —— 从能力落地到价值跃迁 当数字化转型从 “选择题” 变为企业生存的 “必答题”, ...
2025-09-01数据清洗工具全景指南:从入门到进阶的实操路径 在数据驱动决策的链条中,“数据清洗” 是决定后续分析与建模有效性的 “第一道 ...
2025-08-29机器学习中的参数优化:以预测结果为核心的闭环调优路径 在机器学习模型落地中,“参数” 是连接 “数据” 与 “预测结果” 的关 ...
2025-08-29CDA 数据分析与量化策略分析流程:协同落地数据驱动价值 在数据驱动决策的实践中,“流程” 是确保价值落地的核心骨架 ——CDA ...
2025-08-29CDA含金量分析 在数字经济与人工智能深度融合的时代,数据驱动决策已成为企业核心竞争力的关键要素。CDA(Certified Data Analys ...
2025-08-28CDA认证:数据时代的职业通行证 当海通证券的交易大厅里闪烁的屏幕实时跳动着市场数据,当苏州银行的数字金融部连夜部署新的风控 ...
2025-08-28