
Python工具中数据分析常用的包和模块
numpy: 数组、 向量、 矩阵、 数值运算等
scipy: 统计推断、 统计检验等
statsmodel: 统计建模、 模型验证等
scikit-learn: 数据清洗、 机器学习建模、 交叉验证等
matplotlib: 绘图
nltk: 自然语言处理
近几年Python的增长势头一直非常迅猛,写个web服务可以用Python、写个服务器脚本可以用Python、数据清洗和网络爬虫可以用Python、做机器学习数据挖掘可以用Python等等,Python 作为 AI 时代头牌语言的位置基本确立。
感谢上期学员的反馈,他们觉得3天学习时间不过瘾,于是Python数据挖掘课程变成4天了,跟着覃老师一起领悟数据挖掘算法精髓。强化的培训,应该让你可以学完后很自信,学以致用,快速上手解决工作中的问题。
2018年抓紧时间学习python技能,我们一起再出发,报名后获得预习视频和资料。
一、 课程安排
上课时间:2018年4月21—24日
上课地点:深圳市南山区科技园北区科技北一路17号摩比大厦
现场费用:3600/2800元(学生价格2800元 仅限全日制本科生及硕士研究生)
直播费用:2800元/人(同步上课时间 课程内容)
每天授课:上午9:00-12:00;下午13:30-16:30;16:30-17:00(答疑)
课程优惠:
1.现场班老学员9折优惠;
2.同一单位三人以上同时报名9折优惠;
以上优惠不叠加
二、 学员对象
1.数据分析和数据挖掘爱好者
2.算法部分有大学数学基础即可
三、授课老师
覃老师,早年毕业于中国人民大学统计学院,近 20 年来一直进行着数据分析的理论和实践,熟悉数据分析与建模,擅长使用Python、R语言、SAS和Spark解决大数据建模及算法优化难题,积累了大量实践案例,经验丰富;善于用逻辑贯穿数据分析过程,把深奥的思想和方法用通俗易懂的语言讲述清楚透彻,善于用数据分析计算机程序实现从数据到结论到预测的落地过程。2010 年至今培养了上万名(包括首批)使用R语言、SAS和Python等工具实现数据分析和挖掘的专业人士,帮助他们在数据挖掘领域提升工作技能或实现就业。
覃老师曾在某世界500强金融业公司工作期间曾带队负责开发国内首款基于数据分析建模、随机模拟和最优化精确计算的金融年金产品,该产品销售额持续领跑同业市场多年,获得金融产品创新大奖。
覃老师培训或完成过数据分析和挖掘项目的企业有中国人寿、陆金所、中国建设银行、汇丰银行、北京银行、渤海银行、宁波银行、吴江农商行、中国移动等。
四、课程大纲:
第一阶段: Python 基础精要,零基础也能学会
1. 语法初步
2. 列表、字符串和元组
3. 集合与字典
4. 条件和循环语句
5. 若干重要内置函数应用
6. 文件操作
7. 函数及其应用
8. 正则表达式
9. 数据库和 Python
10.排序算法、 动态规划算法、递归算法等算法
第二阶段:numpy、pandas等进行数据清洗和整理,充分统计分析数据
1. 整理数据(切片、产生随机数、复制、广播、排序等)
2. 数据索引和选择的各种方法
3. 数据的分组、分割、合并、变形
4. 缺失值和空值的数据处理
5. 时间序列数据处理、建模和预测(ARIMA)
6. 含中文数据的处理
7. 数据去重、去离群值
8. R语言和Python(pandas)数据整理和建模的比较
9. 描述统计和推论统计分析
1. 文本挖掘原理和案例(Logistic 回归模型对文本的分类)
2. 预测分析核心算法(图片的K-means聚类分析)
4. 概率统计(二维手写数字识别 KNN方法)
5. 数据可视化(推荐系统和精准营销 最近邻方法、协同过滤)
6. 金融建模分析(数据可视化的各种情形)
7. 客户画像和精准营销(新闻的文本分类 TF-IDF准则、旅游新闻个性化推荐)
8. 算法和模型的优化(手写识别)
9. 模型精度评估和提升(朴素贝叶斯决策)
10.特征选取的方法(酒的品质分类预测)
11.最佳K-means分类数(机器学习的格点搜索和参数寻优)
12.交叉验证(惩罚线性回归分类器)
13.不平衡数据处理(使用支持向量机识别和分类)
14.XGBoost 使用案例 (金融时间序列预测)
15.贝叶斯分析(机器集成学习算法)
16.逼近和最优化 (随机模拟)
17.自然语言概率图模型(用户流失预警)
18 马尔科夫&蒙特卡罗(量化投资实战)
4天课程内容有点烧脑,想学习的朋友报名从速,点击阅读原文,缴费后获得预习视频和资料。
五、在线咨询
张老师:
座机:010-68456523
QQ:2881989712
扫码添加微信
数据分析咨询请扫描二维码
若不方便扫码,搜微信号:CDAshujufenxi
Python HTTP 请求工具对比:urllib.request 与 requests 的核心差异与选择指南 在 Python 处理 HTTP 请求(如接口调用、数据爬取 ...
2025-09-12解决 pd.read_csv 读取长浮点数据的科学计数法问题 为帮助 Python 数据从业者解决pd.read_csv读取长浮点数据时的科学计数法问题 ...
2025-09-12CDA 数据分析师:业务数据分析步骤的落地者与价值优化者 业务数据分析是企业解决日常运营问题、提升执行效率的核心手段,其价值 ...
2025-09-12用 SQL 验证业务逻辑:从规则拆解到数据把关的实战指南 在业务系统落地过程中,“业务逻辑” 是连接 “需求设计” 与 “用户体验 ...
2025-09-11塔吉特百货孕妇营销案例:数据驱动下的精准零售革命与启示 在零售行业 “流量红利见顶” 的当下,精准营销成为企业突围的核心方 ...
2025-09-11CDA 数据分析师与战略 / 业务数据分析:概念辨析与协同价值 在数据驱动决策的体系中,“战略数据分析”“业务数据分析” 是企业 ...
2025-09-11Excel 数据聚类分析:从操作实践到业务价值挖掘 在数据分析场景中,聚类分析作为 “无监督分组” 的核心工具,能从杂乱数据中挖 ...
2025-09-10统计模型的核心目的:从数据解读到决策支撑的价值导向 统计模型作为数据分析的核心工具,并非简单的 “公式堆砌”,而是围绕特定 ...
2025-09-10CDA 数据分析师:商业数据分析实践的落地者与价值创造者 商业数据分析的价值,最终要在 “实践” 中体现 —— 脱离业务场景的分 ...
2025-09-10机器学习解决实际问题的核心关键:从业务到落地的全流程解析 在人工智能技术落地的浪潮中,机器学习作为核心工具,已广泛应用于 ...
2025-09-09SPSS 编码状态区域中 Unicode 的功能与价值解析 在 SPSS(Statistical Product and Service Solutions,统计产品与服务解决方案 ...
2025-09-09CDA 数据分析师:驾驭商业数据分析流程的核心力量 在商业决策从 “经验驱动” 向 “数据驱动” 转型的过程中,商业数据分析总体 ...
2025-09-09R 语言:数据科学与科研领域的核心工具及优势解析 一、引言 在数据驱动决策的时代,无论是科研人员验证实验假设(如前文中的 T ...
2025-09-08T 检验在假设检验中的应用与实践 一、引言 在科研数据分析、医学实验验证、经济指标对比等领域,常常需要判断 “样本间的差异是 ...
2025-09-08在商业竞争日益激烈的当下,“用数据说话” 已从企业的 “加分项” 变为 “生存必需”。然而,零散的数据分析无法持续为业务赋能 ...
2025-09-08随机森林算法的核心特点:原理、优势与应用解析 在机器学习领域,随机森林(Random Forest)作为集成学习(Ensemble Learning) ...
2025-09-05Excel 区域名定义:从基础到进阶的高效应用指南 在 Excel 数据处理中,频繁引用单元格区域(如A2:A100、B3:D20)不仅容易出错, ...
2025-09-05CDA 数据分析师:以六大分析方法构建数据驱动业务的核心能力 在数据驱动决策成为企业共识的当下,CDA(Certified Data Analyst) ...
2025-09-05SQL 日期截取:从基础方法到业务实战的全维度解析 在数据处理与业务分析中,日期数据是连接 “业务行为” 与 “时间维度” 的核 ...
2025-09-04在卷积神经网络(CNN)的发展历程中,解决 “梯度消失”“特征复用不足”“模型参数冗余” 一直是核心命题。2017 年提出的密集连 ...
2025-09-04