
《ibm spss modeler数据与文本挖掘实战》_数据分析师书籍推荐
《ibm spss modeler数据与文本挖掘实战》
图书简介:
本书主要包括两部分内容:在数据挖掘部分,重点介绍了各种数据挖掘方法的基本原理及应用,包括回归分析、时间序列分析、因子分析、决策树分析、判别分析、聚类分析、人工神经网络、贝叶斯网络以及社交网络分析等;在文本挖掘部分,重点介绍了文本挖掘的节点,以及具体的实现过程。每一章都详细介绍了数据和文本挖掘的基本原理和分析过程,同时在实例中也介绍了SPSS Modeler中大部分节点的使用方法及应用步骤。
本书与同类书籍相比,安排了较多的实例,使读者能够边学边练,在短时间内就可以有一个较大的提高,方便读者熟悉SPSS Modeler的基本操作,并通过系统的案例使读者掌握应用技巧。
本书对于高校理工学科、经济金融学科及数量分析方面的学生,以及数据挖掘和分析方面的研究人员和从业人员等,具有很强的可读性、可操作性与可使用性,尤其适合商业销售、经济管理、社会研究和人文教育等行业的相关人员阅读。
目录
第1部分数据挖掘篇
第1章数据挖掘概述 3
1.1什么是数据挖掘 3
1.1.1数据挖掘的定义 4
1.1.2数据挖掘的发展阶段 5
1.2与传统技术的比较 8
1.2.3数据挖掘和OLAP 9
1.2.4数据挖掘和Web挖掘 10
1.3常用的数据挖掘软件 11
1.3.1SAS EM 12
1.3.2SPSS Modeler 13
1.3.3Intelligent Miner 13
1.4应用实例:目标客户分析 15
1.4.1研究方法 15
1.4.2数据分析 15
1.4.3研究结论 26
第2章SPSS Modeler软件概述 27
2.1软件简介 27
2.1.1软件发展 28
2.1.2软件界面 30
2.1.3软件特点 35
2.1.4软件功能 37
2.1.5软件算法 39
2.1.6高级功能 41
2.1.7软件安装 42
2.2行业应用 50
2.2.1通信行业 50
2.2.2ZF行业 52
2.2.3金融行业 53
2.2.4制造行业 54
2.2.5医药行业 56
2.2.6教育科研 56
2.2.7市场调研 57
2.2.8连锁零售 57
2.3数据挖掘流程 58
2.3.1业务理解 58
2.3.2数据理解 59
2.3.3数据准备 60
2.3.4建立模型 61
2.3.5评估模型 61
2.3.6应用模型 62
2.4应用实例:药物效果研究 62
2.4.1研究方法 63
2.4.2数据分析 63
2.4.3研究结论 69
第3章SPSS Modeler基础操作 70
3.1数据输入 70
3.1.1数据库 71
3.1.2可变文件 73
3.1.3固定文件 75
3.1.4SAS文件 76
3.1.5Statistics文件 77
3.1.6Excel文件 77
3.2数据流操作 78
3.2.1生成数据流 78
3.2.2添加和删除节点 79
3.2.3连接数据流 79
3.2.4修改连接节点 80
3.2.5执行数据流 81
3.3图形制作 82
3.3.1散点图 82
3.3.2直方图 84
3.3.3网络图 85
3.3.4评估图 87
3.4应用实例:产品销售预测 88
3.4.1研究方法 88
3.4.2数据分析 88
3.4.3研究结论 99
第4章回归分析 100
4.1回归分析模型概述 100
4.1.1模型定义 101
4.1.2模型应用 102
4.1.3建模步骤 103
4.1.4注意事项 103
4.2应用实例:客户流失因素分析 104
数据分析咨询请扫描二维码
若不方便扫码,搜微信号:CDAshujufenxi
在数据成为新时代“石油”的今天,几乎每个职场人都在焦虑: “为什么别人能用数据驱动决策、升职加薪,而我面对Excel表格却无从 ...
2025-10-18数据清洗是 “数据价值挖掘的前置关卡”—— 其核心目标是 “去除噪声、修正错误、规范格式”,但前提是不破坏数据的真实业务含 ...
2025-10-17在数据汇总分析中,透视表凭借灵活的字段重组能力成为核心工具,但原始透视表仅能呈现数值结果,缺乏对数据背景、异常原因或业务 ...
2025-10-17在企业管理中,“凭经验定策略” 的传统模式正逐渐失效 —— 金融机构靠 “研究员主观判断” 选股可能错失收益,电商靠 “运营拍 ...
2025-10-17在数据库日常操作中,INSERT INTO SELECT是实现 “批量数据迁移” 的核心 SQL 语句 —— 它能直接将一个表(或查询结果集)的数 ...
2025-10-16在机器学习建模中,“参数” 是决定模型效果的关键变量 —— 无论是线性回归的系数、随机森林的树深度,还是神经网络的权重,这 ...
2025-10-16在数字化浪潮中,“数据” 已从 “辅助决策的工具” 升级为 “驱动业务的核心资产”—— 电商平台靠用户行为数据优化推荐算法, ...
2025-10-16在大模型从实验室走向生产环境的过程中,“稳定性” 是决定其能否实用的关键 —— 一个在单轮测试中表现优异的模型,若在高并发 ...
2025-10-15在机器学习入门领域,“鸢尾花数据集(Iris Dataset)” 是理解 “特征值” 与 “目标值” 的最佳案例 —— 它结构清晰、维度适 ...
2025-10-15在数据驱动的业务场景中,零散的指标(如 “GMV”“复购率”)就像 “散落的零件”,无法支撑系统性决策;而科学的指标体系,则 ...
2025-10-15在神经网络模型设计中,“隐藏层层数” 是决定模型能力与效率的核心参数之一 —— 层数过少,模型可能 “欠拟合”(无法捕捉数据 ...
2025-10-14在数字化浪潮中,数据分析师已成为企业 “从数据中挖掘价值” 的核心角色 —— 他们既要能从海量数据中提取有效信息,又要能将分 ...
2025-10-14在企业数据驱动的实践中,“指标混乱” 是最常见的痛点:运营部门说 “复购率 15%”,产品部门说 “复购率 8%”,实则是两者对 ...
2025-10-14在手游行业,“次日留存率” 是衡量一款游戏生死的 “第一道关卡”—— 它不仅反映了玩家对游戏的初始接受度,更直接决定了后续 ...
2025-10-13分库分表,为何而生? 在信息技术发展的早期阶段,数据量相对较小,业务逻辑也较为简单,单库单表的数据库架构就能够满足大多数 ...
2025-10-13在企业数字化转型过程中,“数据孤岛” 是普遍面临的痛点:用户数据散落在 APP 日志、注册系统、客服记录中,订单数据分散在交易 ...
2025-10-13在数字化时代,用户的每一次行为 —— 从电商平台的 “浏览→加购→购买”,到视频 APP 的 “打开→搜索→观看→收藏”,再到银 ...
2025-10-11在机器学习建模流程中,“特征重要性分析” 是连接 “数据” 与 “业务” 的关键桥梁 —— 它不仅能帮我们筛选冗余特征、提升模 ...
2025-10-11在企业的数据体系中,未经分类的数据如同 “杂乱无章的仓库”—— 用户行为日志、订单记录、商品信息混杂存储,CDA(Certified D ...
2025-10-11在 SQL Server 数据库操作中,“数据类型转换” 是高频需求 —— 无论是将字符串格式的日期转为datetime用于筛选,还是将数值转 ...
2025-10-10