在上一篇文章中我们给大家介绍了关于数据仓库的一部分知识,在介绍了数据仓库提升数据分析的效率中,有三个途径,第一是数据理解,第二是数据质量,第三是数据跨系统关联。在这篇文章中我们为大家介绍数 ...
2019-04-10
其实在数据分析工作中,数据处理所用的时间占据数据分析工作所用时间的七成以上,看到这个比例相信大家会大吃一惊。由此我们可以看出,数据处理是一个十分重要的工作,,其目的就是为了提高分析效率和质 ...
2019-04-10
在上一篇文章中我们提到的数据预处理的数据清洗,数据清洗就是对于肮脏数据的清除,而肮脏数据主要有异常值和缺失值,我们在进行数据预处理的时候不但要注意数据的清洗,还需要注意数据的集成、数据变换 ...
2019-04-10
数据分析中,需要先挖掘数据,然后对数据进行处理,而数据预处理的字面意思就是对于数据的预先处理,而数据预处理的作用是为了提高数据的质量以及使用数据分析软件,对于数据的预处理的具体步骤就是数据 ...
2019-04-10
随着信息化的不断发展,越来越多的人开始了解和学习大数据。但是大家在了解和想学习大数据的时候,一些需要解决的问题还是有很多的。比如大数据需要解决的关键问题,大数据如何走出实验室和工程化落地等 ...
2019-04-09
对于大数据想必大家都有所了解了吧?随着信息化的不断发展,大数据也越来越被人们所熟知。我们都知道,现在很多行业都离不开数据分析,在数据分析中我们有听说了大数据,大数据涉及到了很多的行业,一般 ...
2019-04-09
4月来临,大学毕业季也逐渐被提上日程,很多大学毕业生也开始为自己的工作而发愁。小编的一个远方亲戚,他们的孩子就快毕业了,为此也向小编询问过关于哪种工作比较好的问题,并且告诉小编,他们的孩子想 ...
2019-04-09
相信大多数人都听说过大数据分析这个行业,但是对大数据分析这个领域还是有很多人不理解的,毕竟这个行业是新互联网时代所提出的一个名词。现在很多人都想进入大数据分析这一个新兴职业,毕竟这个职业听 ...
2019-04-09
从事数据分析师的工作,做好自己的数据分析师职业规划,是非常有必要的,它是我们不断向前进取的动力和方向,也是支撑我们坚持下去的理由和需要。一个良好而客观可行的数据分析师职业规划,对于一个人的 ...
2019-04-09
大家都知道,我们在进行数据分析工作的时候会用到数据库这一工具,可能大家还听说过数据仓库这个工具,数据库和数据仓库很容易被大家混淆。很多人认为数据库和数据仓库是一类事物,其实并不只是这样的, ...
2019-04-08
现如今,数据分析和数据挖掘是两个十分有前景的工作。就目前而言,人们在日常生活中都会积累大量的数据,而这些数据经过数据分析或者数据挖掘工作能够获得更大的价值。从字面上了解,数据分析就是去分析 ...
2019-04-08
大家在学习机器学习的时候可能听说过一种算法,这种算法就是朴素贝叶斯算法,而很多人说朴素贝叶斯算法是高偏差低方差,在这篇文章中我们就详细的为大家介绍一下朴素贝叶斯为什么被说高偏差低方差的原因 ...
2019-04-04
我们在学习机器学习的时候总会遇到很多的问题,而这些问题总是导致很多的问题,其实这些都是正常的,我们只有正视这些错误才能够更好地进行操控机器学习,而机器学习的常见错误有很多,我们在这篇文章中 ...
2019-04-04
我们在前面的文章中给大家介绍了很多关于机器学习中常见的错误,当然,这些错误都是需要我们去避免的。在这篇文章中我们继续为大家介绍机器学习中常见的错误,希望大家能够引以为,从而更好地学习机器学 ...
2019-04-04
大家都知道,现如今,人工智能是一个十分火热的概念,其实就目前而言,人工智能已经不能够用概念来形容了,需要用技术来形容,而人工智能的核心就是机器学习,机器学习的要素之一就是模型,那么存在偏差 ...
2019-04-04
在之前的文章中我们给大家介绍了很多关于机器学习的算法知识,通过这些知识我们不难发现每个算法都是有很多功能的,这些功能能够更好地帮助大家理解机器学习的相关知识,在这篇文章中我们给大家介绍一下 ...
2019-04-03
机器学习中有个算法是十分重要的,那就是最近邻算法,这种算法被大家称为KNN。我们在学习机器学习知识的时候一定要学习这种算法,其实不管是什么算法都是有自己的优缺点的,KNN算法也不例外,在这篇文章 ...
2019-04-03
大家都知道,机器学习中有很多算法,比如说决策树,随机森林,线性回归等等,其实这些算法都是有很多优点,同时也是有很多的缺点。我们在这篇文章中给大家介绍一下ID3、C4.5算法、CART分类与回归树和Adab ...
2019-04-03
决策树在机器学习中是一个十分优秀的算法,在很多技术中都需要用到决策树这一算法,由此可见,决策树是一个经典的算法,在这篇文章中我们给大家介绍决策树算法的优缺点,希望这篇文章能够更好的帮助大家 ...
2019-04-02
接触过机器学习的朋友应该知道,样本是机器学习模型的核心,这是因为样本直接关系到模型效果的好坏,不过在大多数情况下,很多人对待样本的态度根本不够,这就导致的机器学习中的错误。很多人关注样本不 ...
2019-04-02在存量竞争时代,用户流失率直接影响企业的营收与市场竞争力。无论是电商、互联网服务还是金融行业,提前精准预测潜在流失用户, ...
2026-01-09在量化投资领域,多因子选股是主流的选股策略之一——其核心逻辑是通过挖掘影响股票未来收益的各类因子(如估值、成长、盈利、流 ...
2026-01-09在CDA(Certified Data Analyst)数据分析师的工作场景中,分类型变量的关联分析是高频需求——例如“用户性别与商品偏好是否相 ...
2026-01-09数据库中的历史数据,是企业运营过程中沉淀的核心资产——包含用户行为轨迹、业务交易记录、产品迭代日志、市场活动效果等多维度 ...
2026-01-08在电商行业竞争日趋激烈的当下,数据已成为驱动业务增长的核心引擎。电商公司的数据分析师,不仅是数据的“解读官”,更是业务的 ...
2026-01-08在数据驱动决策的链路中,统计制图是CDA(Certified Data Analyst)数据分析师将抽象数据转化为直观洞察的关键载体。不同于普通 ...
2026-01-08在主成分分析(PCA)的学习与实践中,“主成分载荷矩阵”和“成分矩阵”是两个高频出现但极易混淆的核心概念。两者均是主成分分 ...
2026-01-07在教学管理、学生成绩分析场景中,成绩分布图是直观呈现成绩分布规律的核心工具——通过图表能快速看出成绩集中区间、高分/低分 ...
2026-01-07在数据分析师的工作闭环中,数据探索与统计分析是连接原始数据与业务洞察的关键环节。CDA(Certified Data Analyst)作为具备专 ...
2026-01-07在数据处理与可视化场景中,将Python分析后的结果导出为Excel文件是高频需求。而通过设置单元格颜色,能让Excel中的数据更具层次 ...
2026-01-06在企业运营、业务监控、数据分析等场景中,指标波动是常态——无论是日营收的突然下滑、用户活跃度的骤升,还是产品故障率的异常 ...
2026-01-06在数据驱动的建模与分析场景中,“数据决定上限,特征决定下限”已成为行业共识。原始数据经过采集、清洗后,往往难以直接支撑模 ...
2026-01-06在Python文件操作场景中,批量处理文件、遍历目录树是高频需求——无论是统计某文件夹下的文件数量、筛选特定类型文件,还是批量 ...
2026-01-05在神经网络模型训练过程中,开发者最担心的问题之一,莫过于“训练误差突然增大”——前几轮还平稳下降的损失值(Loss),突然在 ...
2026-01-05在数据驱动的业务场景中,“垃圾数据进,垃圾结果出”是永恒的警示。企业收集的数据往往存在缺失、异常、重复、格式混乱等问题, ...
2026-01-05在数字化时代,用户行为数据已成为企业的核心资产之一。从用户打开APP的首次点击,到浏览页面的停留时长,再到最终的购买决策、 ...
2026-01-04在数据分析领域,数据稳定性是衡量数据质量的核心维度之一,直接决定了分析结果的可靠性与决策价值。稳定的数据能反映事物的固有 ...
2026-01-04在CDA(Certified Data Analyst)数据分析师的工作链路中,数据读取是连接原始数据与后续分析的关键桥梁。如果说数据采集是“获 ...
2026-01-04尊敬的考生: 您好! 我们诚挚通知您,CDA Level III 考试大纲将于 2025 年 12 月 31 日实施重大更新,并正式启用,2026年3月考 ...
2025-12-31“字如其人”的传统认知,让不少“手残党”在需要签名的场景中倍感尴尬——商务签约时的签名歪歪扭扭,朋友聚会的签名墙不敢落笔 ...
2025-12-31