python清理数据领域的知识。 lambda 表达式是一个匿名函数,lambda表达式基于数学中的λ演算得名,直接对应于其中的lambda抽象,是一个匿名函数,即没有函数名的函数。 lambda表达式可以接受任意数量的参数 ...
2020-05-09
相信接触过Excel的小伙伴都知道,Excel有一个非常强大的功能“数据透视表”,使用数据透视表可以自由选择不同字段,用不同的聚合函数进行汇总,并建立交叉表格,用以从不同层面观察数据。这么强大的功能,在Python ...
2020-05-09
一般大家在学习python机器学习的时候,用的最多的可视化的包就是matplot和seaborn, 这2个可视化的优点在于门槛低,代码容易理解,并且容易上手。唯一的可能的缺点就是画出来的图不能交互,简单来说就是matplot和se ...
2020-05-09
很多企业在营销的时候会提到“用户画像”,那用户画像究竟是什么呢? 其实用户画像就是用户信息标签化,就是企业通过收集与分析消费者社会属性、生活习惯、消费行为等主要信息的数据之后,完美地抽象出 ...
2020-05-09
矩阵分析、矩阵理论、矩阵论是三种较为常见学科,这里为大家介绍一些它们的适用范围和区别。 ——矩阵分析 主要包括线性空间与线性变换,内积空间,矩阵的相似标准形,矩阵分解,矩阵函数等内容, ...
2020-05-08
近几年,数据的增长速度呈现爆炸式趋势,数据营利成为或将成为收入的主要来源。大部分的商业智能应用均针对营销决策,在这一领域的主要影响如下。 (1)、规划分析 数据科学家为营销部门提供了对客户行为 ...
2020-05-08
BI分析几年来越来越流行,我们从最简单的概念BI入手,来诠释出BI分析就是什么? BI,英文全称为:Business Intelligence,中文翻译为商业智能。这个概念最早在1996年提出。当时将商业智能定义为一类由数 ...
2020-05-08
1984年,Light等提出了漏斗图,一般以单个研究的效应量为横坐标,样本含量为纵坐标做的散点图。效应量可以为RR、OR和死亡比或者其对数值等。理论上讲,被纳入Meta分析的各独立研究效应的点估计,在平面坐 ...
2020-05-08
Tableau是一款帮助人们查看并理解数据的软件,拥有强大、安全且灵活的端到端数据分析negligible,可以助力任何人快速分析、可视化并分享信息。在百度百科中显示,目前已有超过42,000家客户通过使用Tableau在 ...
2020-05-07
如今的维度分析方式越来越受大众的欢迎,无论是在数据分析领域,还是学习生活方面,它都能显现出闪光点。 首先,维度分析是一个比较大的范畴,涵盖的方面很多,比如一个主题的多方面,也可以是多个主体 ...
2020-05-07
R语言dplyr包主要用于数据清洗和整理,主要功能有:行选择、列选择、统计汇总、窗口函数、数据框交集等是非常高效、友好的数据处理包,学清楚了,基本上数据能随意玩弄,对的,随意玩弄,简直大大提高数据处理及分 ...
2020-05-07
随着人工智能的飞速发展,机器学习成为当下数据分析领域的热门之一,很多人在平时的工作中,或多或少都会使用到机器学习的算法。这里机器学习的算法进行了盘点,将有监督、无监督,半监督学习等进行了简单的解 ...
2020-05-06
网上找到的有关python语音识别的例子,有一些成熟的模型,可以进行python语音识别,将语音转成文字。例如Cloud Speech API,但是需要你使用google云平台的前提。下面我们一起来看看吧! ...
2020-05-06
内置示例数据集 seaborn内置了十几个示例数据集,通过load_dataset函数可以调用。 其中包括常见的泰坦尼克、鸢尾花等经典数据集。 #查看数据集种类 importseabornassns sn ...
2020-04-28
首先先看一下效果: 一、创建饼状图对象 创建饼状图对象用到类是PieChartView.h, 代码如下: self.pieChartView = [[PieChartView alloc] init]; self.pieChartVi ...
2020-04-28
把这三个包放在一起有几个原因:首先 Seaborn 和 Pandas 是建立在 Matplotlib 之上的,当你在用 Seaborn 或 Pandas 中的 df.plot() 时,用的其实是别人用 Matplotlib 写的代码。因此,这些图在美化方面是 ...
2020-04-28
CDA数据分析师 出品 近日,新冠肺炎防控成果的好消息不断。 今天我们聊聊,惊艳的疫情直观图。 据国家卫健委数据统计, 截止至3月10日24时,31省区市累计治愈出院病历超6 ...
2020-04-28
条形图,应该也是大家非常熟悉的一种图表了。 条形图的识别度极高,用它来视觉化地传达具体数字背后的意义,干净又利落,复杂的数据到了这里,顿时变得一目了然。 现在就让 ...
2020-04-22
今天给大家分享一下如何画出漂亮的箱线图。首先,我们最简单工具画箱线图就是EXCEL,那么我们先介绍一下用EXCEL来画一下。 选中数据,然后点击下插入,选择图表,找到箱线图 ...
2020-04-22
想画SNP标记在不同的染色体的分布密度,但是不知道用什么软件画出来的?说不定在论坛发个贴就能解决你的困扰哦~ 这不,有网友发个贴提问,就有码农分享自己的代码了。小编把代码也贴出来给大家瞄 ...
2020-04-22在存量竞争时代,用户流失率直接影响企业的营收与市场竞争力。无论是电商、互联网服务还是金融行业,提前精准预测潜在流失用户, ...
2026-01-09在量化投资领域,多因子选股是主流的选股策略之一——其核心逻辑是通过挖掘影响股票未来收益的各类因子(如估值、成长、盈利、流 ...
2026-01-09在CDA(Certified Data Analyst)数据分析师的工作场景中,分类型变量的关联分析是高频需求——例如“用户性别与商品偏好是否相 ...
2026-01-09数据库中的历史数据,是企业运营过程中沉淀的核心资产——包含用户行为轨迹、业务交易记录、产品迭代日志、市场活动效果等多维度 ...
2026-01-08在电商行业竞争日趋激烈的当下,数据已成为驱动业务增长的核心引擎。电商公司的数据分析师,不仅是数据的“解读官”,更是业务的 ...
2026-01-08在数据驱动决策的链路中,统计制图是CDA(Certified Data Analyst)数据分析师将抽象数据转化为直观洞察的关键载体。不同于普通 ...
2026-01-08在主成分分析(PCA)的学习与实践中,“主成分载荷矩阵”和“成分矩阵”是两个高频出现但极易混淆的核心概念。两者均是主成分分 ...
2026-01-07在教学管理、学生成绩分析场景中,成绩分布图是直观呈现成绩分布规律的核心工具——通过图表能快速看出成绩集中区间、高分/低分 ...
2026-01-07在数据分析师的工作闭环中,数据探索与统计分析是连接原始数据与业务洞察的关键环节。CDA(Certified Data Analyst)作为具备专 ...
2026-01-07在数据处理与可视化场景中,将Python分析后的结果导出为Excel文件是高频需求。而通过设置单元格颜色,能让Excel中的数据更具层次 ...
2026-01-06在企业运营、业务监控、数据分析等场景中,指标波动是常态——无论是日营收的突然下滑、用户活跃度的骤升,还是产品故障率的异常 ...
2026-01-06在数据驱动的建模与分析场景中,“数据决定上限,特征决定下限”已成为行业共识。原始数据经过采集、清洗后,往往难以直接支撑模 ...
2026-01-06在Python文件操作场景中,批量处理文件、遍历目录树是高频需求——无论是统计某文件夹下的文件数量、筛选特定类型文件,还是批量 ...
2026-01-05在神经网络模型训练过程中,开发者最担心的问题之一,莫过于“训练误差突然增大”——前几轮还平稳下降的损失值(Loss),突然在 ...
2026-01-05在数据驱动的业务场景中,“垃圾数据进,垃圾结果出”是永恒的警示。企业收集的数据往往存在缺失、异常、重复、格式混乱等问题, ...
2026-01-05在数字化时代,用户行为数据已成为企业的核心资产之一。从用户打开APP的首次点击,到浏览页面的停留时长,再到最终的购买决策、 ...
2026-01-04在数据分析领域,数据稳定性是衡量数据质量的核心维度之一,直接决定了分析结果的可靠性与决策价值。稳定的数据能反映事物的固有 ...
2026-01-04在CDA(Certified Data Analyst)数据分析师的工作链路中,数据读取是连接原始数据与后续分析的关键桥梁。如果说数据采集是“获 ...
2026-01-04尊敬的考生: 您好! 我们诚挚通知您,CDA Level III 考试大纲将于 2025 年 12 月 31 日实施重大更新,并正式启用,2026年3月考 ...
2025-12-31“字如其人”的传统认知,让不少“手残党”在需要签名的场景中倍感尴尬——商务签约时的签名歪歪扭扭,朋友聚会的签名墙不敢落笔 ...
2025-12-31