
人人都能掌握的6个数据分析工具
大数据时代人人都拥有数据,但是提到数据分析,听起来似乎是专家才能做的事情。确实,如果你想成为数据科学家,那么好好学习机器学习、Hadoop和R吧。不过如果你只是想简单地做些分析,那么还是有一些学习曲线不那么陡峭的“傻瓜”工具可用,以下是GigaOM的博客作者Derrick Harris推荐的6款免费在线数据分析工具,IT经理网为大家试用点评如下:
BigML是一个机器学习的工具。 如果拿数码摄影做类比, BigML使用起来简单得就像傻瓜相机那样, 同时有具备了单反的功能。 用户只需要上传数据, 格式化数据, 然后BigML就根据这些变量生成一个预测模型。 就这么简单。 下图就是Derrick Harris根据自己在用健康应用App软件Fitbit统计出来自己一天的活动数据和消耗的卡路里, BigML做出的预测模型。
Google Fusion Table 是Google的一个实验性数据可视化工具。用户界面算不上多好,不过使用非常简单。下图就是Derrick Harris把公开的各国枪支犯罪的数据上传上去得出的可视化地图。
如果你的数据量不大,比如列数和行数不多的话。Infogram 是个不错的可视化选择。Infrogram最初提供信息图的模板,而去年又开始增加了大量的图表的模板。用户上传数据后,可以生成互动的图表,这些图表可以嵌入网页使用。
此外,Infogram还提供了一些样本数据供用户试验。用户可以看这些样本数据生成的图表,如果喜欢的话,可以用自己的数据替换。
下图是本站编辑根据本站的文章“GE的千亿美元数据转型”进行词频分析并用Infogram生成的词频表以及词云图。
Many Eyes是IBM的一个Web服务。提供很多可视化的工具,包括各种图表。而Many Eyes最强的就是文本分析功能。
下图就是利用Many Eye上的数据例子对马丁路德金牧师的“我有一个梦”进行文本分析产生的词云图(Many Eyes 还不支持中文分词)。
此外,Many Eyes的文本分析还能显示词组的关联,让你知道作者常用的词组关联是哪些。
比如“我有一个梦”的演讲里Freedom出现的频次最多。 我们还可以建一个单词树,来专门看从Freedom延伸下去的词。
Statwing是一个非常简单的教会用户使用统计图表的应用。你只需要上传数据,把你需要关注的变量打上勾,Statwing就可以把统计关系图画出来。而且可以把各个变量的样本大小,最大最小值, 平均数, 中位数以及标准方差等一系列统计指标列出来。
下图是Derrick Harris上传的自己的Fitbit的数据。 试图研究一下自己的每天活动和卡路里消耗量的关系。
Tableau Public 是Tableau的免费版本。它需要一些结构化的数据,也需要你懂一些BI。不过类似于拖拽这样的功能,对于那些想试试的用户来说,还是比较方便的。
下图是根据data.gov上最近7天的地震数据用Tableau生成的可视化的图。读者也可以试一试, 数据在这里
总结: 这些数据分析及可视化的工具,可以很简单地帮助用户实现一些看起来很难的分析或者可视化。 对于那些想试着上手的用户来说, 是一个接触数据分析和可视化的捷径。 不过, 需要注意的是,很多工具需要的是结构化的数据,比如列作为变量, 行做为样本。因此,在使用这些工具之前, 需要对数据进行清洗, 把数据整理成为可用的格式才可以使用。
数据分析咨询请扫描二维码
若不方便扫码,搜微信号:CDAshujufenxi
随机森林算法的核心特点:原理、优势与应用解析 在机器学习领域,随机森林(Random Forest)作为集成学习(Ensemble Learning) ...
2025-09-05Excel 区域名定义:从基础到进阶的高效应用指南 在 Excel 数据处理中,频繁引用单元格区域(如A2:A100、B3:D20)不仅容易出错, ...
2025-09-05CDA 数据分析师:以六大分析方法构建数据驱动业务的核心能力 在数据驱动决策成为企业共识的当下,CDA(Certified Data Analyst) ...
2025-09-05SQL 日期截取:从基础方法到业务实战的全维度解析 在数据处理与业务分析中,日期数据是连接 “业务行为” 与 “时间维度” 的核 ...
2025-09-04在卷积神经网络(CNN)的发展历程中,解决 “梯度消失”“特征复用不足”“模型参数冗余” 一直是核心命题。2017 年提出的密集连 ...
2025-09-04CDA 数据分析师:驾驭数据范式,释放数据价值 在数字化转型浪潮席卷全球的当下,数据已成为企业核心生产要素。而 CDA(Certified ...
2025-09-04K-Means 聚类:无监督学习中数据分群的核心算法 在数据分析领域,当我们面对海量无标签数据(如用户行为记录、商品属性数据、图 ...
2025-09-03特征值、特征向量与主成分:数据降维背后的线性代数逻辑 在机器学习、数据分析与信号处理领域,“降维” 是破解高维数据复杂性的 ...
2025-09-03CDA 数据分析师与数据分析:解锁数据价值的关键 在数字经济高速发展的今天,数据已成为企业核心资产与社会发展的重要驱动力。无 ...
2025-09-03解析 loss.backward ():深度学习中梯度汇总与同步的自动触发核心 在深度学习模型训练流程中,loss.backward()是连接 “前向计算 ...
2025-09-02要解答 “画 K-S 图时横轴是等距还是等频” 的问题,需先明确 K-S 图的核心用途(检验样本分布与理论分布的一致性),再结合横轴 ...
2025-09-02CDA 数据分析师:助力企业破解数据需求与数据分析需求难题 在数字化浪潮席卷全球的当下,数据已成为企业核心战略资产。无论是市 ...
2025-09-02Power BI 度量值实战:基于每月收入与税金占比计算累计税金分摊金额 在企业财务分析中,税金分摊是成本核算与利润统计的核心环节 ...
2025-09-01巧用 ALTER TABLE rent ADD INDEX:租房系统数据库性能优化实践 在租房管理系统中,rent表是核心业务表之一,通常存储租赁订单信 ...
2025-09-01CDA 数据分析师:企业数字化转型的核心引擎 —— 从能力落地到价值跃迁 当数字化转型从 “选择题” 变为企业生存的 “必答题”, ...
2025-09-01数据清洗工具全景指南:从入门到进阶的实操路径 在数据驱动决策的链条中,“数据清洗” 是决定后续分析与建模有效性的 “第一道 ...
2025-08-29机器学习中的参数优化:以预测结果为核心的闭环调优路径 在机器学习模型落地中,“参数” 是连接 “数据” 与 “预测结果” 的关 ...
2025-08-29CDA 数据分析与量化策略分析流程:协同落地数据驱动价值 在数据驱动决策的实践中,“流程” 是确保价值落地的核心骨架 ——CDA ...
2025-08-29CDA含金量分析 在数字经济与人工智能深度融合的时代,数据驱动决策已成为企业核心竞争力的关键要素。CDA(Certified Data Analys ...
2025-08-28CDA认证:数据时代的职业通行证 当海通证券的交易大厅里闪烁的屏幕实时跳动着市场数据,当苏州银行的数字金融部连夜部署新的风控 ...
2025-08-28