Python数据分析与可视化案例教程(微课版)

七大主流分析场景实战,通过鸢尾花分类分析、股票收盘价分析等真实案例练习,掌握经典算法以及BERT模型、BiLSTM模型等前沿技术。
分享 推荐 0 收藏 8 阅读 485
葛继科 (作者) 978-7-115-69303-7

关于本书的内容有任何问题,请联系 龚柔琦

1️⃣ 知识体系科学完备,循序渐进助力自学
     本书从数据分析与可视化的基本概念入手,围绕分类、回归、聚类、关联规则、时序数据、文本数据、社交网络数据七大主流分析场景,结合真实案例,逐层剖析算法的原理、Python 实现与可视化呈现,形成“理论→代码→图形→洞见”的完整闭环。
2️⃣ 图数结合强化理解,双向驱动创新思路
     与传统教材将“分析”与“可视化”相割裂不同,本书创新性地将二者贯穿始终。这种“以图释数、以数验图”的设计,有助于读者直观理解复杂模型,提升结果解释能力。
3️⃣ 融入丰富实战案例,贴近行业实际应用
     本书第4~10章每章均包含丰富的实战案例,涵盖鸢尾花分类分析、股票收盘价分析、手机评论文本情感分析等真实场景。书中代码注重可复现性。本书提供完整的数据集与参数配置说明,可以培养读者解决实际问题的全局思维。
4️⃣ 紧密跟踪前沿技术,拓宽读者科技视野
     本书在夯实经典方法(如线性回归、k 均值聚类等)的基础上,引入自然语言处理、BERT 模型、BiLSTM 模型等前沿技术,并通过可视化对比传统方法与新技术的性能差异,帮助读者把握领域发展趋势。

内容摘要

        本书是一本集理论与实践于一体的新形态教材,全书共10章,内容包括基本概念与基础知识、数据分析、数据可视化、分类分析与可视化、回归分析与可视化、聚类分析与可视化、关联规则分析与可视化、时序数据分析与可视化、文本数据分析与可视化、社交网络数据分析与可视化。本书在讲解理论知识的同时,还提供大量的实用案例,突出工程应用,力求做到基本概念准确、阐述条理清晰、主体内容精练、重点难点突出、理论联系实际。
        本书可作为计算机科学与技术、数据科学与大数据技术、人工智能等专业大数据技术类课程的教材,也可供相关领域的科技人员参考使用,还可作为数据分析与应用类认证培训课程的教材。

目录

【章名目录】
第1章 基本概念与基础知识
第2章 数据分析
第3章 数据可视化
第4章 分类分析与可视化
第5章 回归分析与可视化
第6章 聚类分析与可视化
第7章 关联规则分析与可视化
第8章 时序数据分析与可视化
第9章 文本数据分析与可视化
第10章 社交网络数据分析与可视化

【详细目录】
第 1章 基本概念与基础知识
1.1 数据要素 2
1.1.1 数据要素的定义及特点 2
1.1.2 数据要素的价值 3
1.1.3 数据作为“新资源”的价值 4
1.1.4 数据作为“新资产”的价值 5
1.1.5 数据作为“新资本”的价值 5
1.2 大数据概述 5
1.2.1 大数据的概念 6
1.2.2 大数据的特征 7
1.2.3 大数据思维 8
1.2.4 大数据伦理 9
1.3 Python数据分析与可视化 12
1.3.1 选用Python进行数据分析与可视化的原因 12
1.3.2 Python数据分析与可视化常用库 13
1.3.3 安装Anaconda开发环境 13
1.3.4 Jupyter Notebook开发工具的使用 16
1.3.5 Markdown的使用 18
本章小结 19
习题 20

第 2章 数据分析
2.1 数据分析概述 22
2.1.1 数据分析的概念 22
2.1.2 数据分析与机器学习的关系 22
2.1.3 数据分析的目的和作用 23
2.1.4 数据分析流程 24
2.2 数据分析指标体系 25
2.2.1 数据指标的定义 25
2.2.2 数据分析指标体系的建立 25
2.2.3 数据分析指标体系的应用 27
2.3 数据分析方法 28
2.3.1 比较分析法 28
2.3.2 分组分析法 29
2.3.3 结构分析法 29
2.3.4 矩阵分析法 29
2.3.5 漏斗图分析法 29
2.3.6 综合评价分析法 30
2.4 数据分析报告 30
2.4.1 数据分析报告的类型 31
2.4.2 数据分析报告的基本组成 31
2.4.3 完成数据分析报告的建议 31
2.4.4 数据分析报告示例 32
2.5 数据对象的相似性度量 33
2.5.1 数据对象之间的相异性 34
2.5.2 数值属性对象的相似性度量 34
2.5.3 二元属性的相似性度量 36
2.5.4 余弦相似度 37
本章小结 38
习题 38

第3章 数据可视化
3.1 数据可视化概述 40
3.1.1 数据可视化的概念 40
3.1.2 数据可视化的目的和作用 40
3.1.3 数据可视化的分类 40
3.2 数据可视化流程与基础图表 41
3.2.1 数据可视化的流程 41
3.2.2 数据可视化的基础图表 43
3.2.3 数据可视化图表类型的选择 48
3.3 Python数据可视化方法 49
3.3.1 Matplotlib绘制图表 49
3.3.2 Seaborn绘制图表 50
3.3.3 Plotly绘制交互式图表 51
3.3.4 Bokeh绘制交互式网页图表 52
3.3.5 Pygal绘制矢量图 52
3.3.6 NetworkX绘制网络图 53
3.3.7 wordcloud绘制词云 54
本章小结 55
习题 55

第4章 分类分析与可视化
4.1 分类概述 57
4.1.1 分类的基本概念 57
4.1.2 分类的一般流程 57
4.1.3 常用分类方法 58
4.2 决策树分类 59
4.2.1 决策树简介 59
4.2.2 决策树的构建 59
4.2.3 特征选择标准 60
4.2.4 ID3算法 61
4.2.5 ID3算法的实现 62
4.2.6 C4.5算法 65
4.2.7 CART算法 66
4.2.8 决策树模型及其可视化 67
4.3 逻辑斯谛回归 70
4.3.1 逻辑斯谛回归的原理 70
4.3.2 逻辑斯谛回归的代码实现 71
4.3.3 逻辑斯谛回归实现乳腺癌预测 73
4.4 k近邻算法 74
4.4.1 k近邻算法的原理 74
4.4.2 k近邻算法的实现 75
4.4.3 k近邻实现手写数字识别 76
4.5 综合案例:鸢尾花分类分析与可视化 77
4.5.1 案例需求 77
4.5.2 数据准备 78
4.5.3 分类分析与可视化 81
本章小结 82
习题 83

第5章 回归分析与可视化
5.1 回归分析概述 85
5.1.1 回归分析的定义与分类 85
5.1.2 回归分析的流程 85
5.2 线性回归 86
5.2.1 一元线性回归 86
5.2.2 多元线性回归 88
5.2.3 线性回归的Python实现 90
5.3 非线性回归 92
5.3.1 非线性回归简介 92
5.3.2 多项式回归的原理 94
5.3.3 多项式回归的实现 95
5.3.4 应用举例 96
5.4 支持向量回归 97
5.4.1 支持向量回归简介 98
5.4.2 支持向量回归的原理 98
5.4.3 支持向量回归的实现 99
5.4.4 应用举例 101
5.5 综合案例:波士顿房价预测分析与可视化 102
5.5.1 案例需求 102
5.5.2 数据准备 103
5.5.3 回归分析与可视化 106
本章小结 110
习题 110

第6章 聚类分析与可视化
6.1 聚类概述 113
6.1.1 聚类的基本概念 113
6.1.2 聚类与分类的区别 113
6.1.3 聚类的一般流程 114
6.1.4 常用聚类方法 115
6.2 k均值聚类算法 117
6.2.1 k均值聚类算法简介 117
6.2.2 k均值聚类算法的原理 117
6.2.3 k均值聚类算法的实现 118
6.3 BIRCH算法 120
6.3.1 BIRCH算法简介 120
6.3.2 BIRCH算法的原理 120
6.3.3 BIRCH算法的实现 121
6.4 DBSCAN算法 124
6.4.1 DBSCAN算法简介 124
6.4.2 DBSCAN算法的原理 125
6.4.3 DBSCAN算法的实现 126
6.5 综合案例:信用评分数据分析与可视化 129
6.5.1 案例需求 129
6.5.2 数据准备 130
6.5.3 聚类分析与可视化 133
本章小结 137
习题 137

第7章 关联规则分析与可视化
7.1 关联规则分析概述 141
7.1.1 关联规则分析的相关概念 141
7.1.2 关联规则分析的应用领域 144
7.2 Apriori算法 145
7.2.1 Apriori算法简介 145
7.2.2 Apriori算法的原理 145
7.2.3 Apriori算法的实现 147
7.3 FP-Growth算法 151
7.3.1 FP-Growth算法简介 152
7.3.2 FP-Growth算法的原理 152
7.3.3 FP-Growth算法的实现 156
7.4 综合案例:购物篮数据集关联规则分析与可视化 160
7.4.1 案例需求 160
7.4.2 数据准备 160
7.4.3 关联规则分析与可视化 161
本章小结 166
习题 166

第8章 时序数据分析与可视化
8.1 时序数据概述 169
8.1.1 时序数据的基本概念 169
8.1.2 时序数据分析的一般流程 169
8.1.3 时序数据分析的常用方法 170
8.2 AR模型、MA模型和ARMA模型 172
8.2.1 AR模型 172
8.2.2 MA模型 173
8.2.3 ARMA模型 173
8.2.4 应用举例 174
8.3 ARIMA模型 178
8.3.1 ARIMA模型简介 178
8.3.2 ARIMA模型的原理 178
8.3.3 ARIMA模型的实现 179
8.4 综合案例:股票收盘价分析与可视化 182
8.4.1 案例需求 182
8.4.2 数据准备 183
8.4.3 时序数据分析与可视化 185
本章小结 188
习题 188

第9章 文本数据分析与可视化
9.1 文本数据概述 191
9.1.1 文本数据的来源 191
9.1.2 文本数据的特点 192
9.1.3 文本数据的获取与处理 193
9.2 文本情感分析 193
9.2.1 文本情感分析方法简介 194
9.2.2 文本情感分析的基本原理 194
9.2.3 文本情感分析的代码实现 197
9.2.4 应用举例 200
9.3 文本相似度分析 202
9.3.1 文本相似度分析方法简介 203
9.3.2 文本相似度分析的基本原理 203
9.3.3 文本相似度分析的代码实现 204
9.3.4 应用举例 207
9.4 综合案例:商品评价分析与可视化 210
9.4.1 案例需求 210
9.4.2 数据准备 210
9.4.3 文本数据分析与可视化 211
本章小结 215
习题 215

第 10章 社交网络数据分析与可视化
10.1 社交网络数据分析概述 218
10.1.1 社交网络数据简介 218
10.1.2 社交网络数据分析的一般流程 219
10.1.3 常用社交网络数据分析方法 220
10.2 BERT模型 223
10.2.1 BERT模型简介 223
10.2.2 BERT模型的原理 224
10.2.3 BERT模型的实现 224
10.3 BiLSTM模型 225
10.3.1 BiLSTM模型简介 226
10.3.2 BiLSTM模型的原理 226
10.3.3 BiLSTM模型的实现 227
10.4 综合案例:手机评论文本情感分析与可视化 228
10.4.1 案例需求 229
10.4.2 数据准备 229
10.4.3 评论文本情感分析与可视化 233
本章小结 240
习题 240
参考文献 242

读者评论

赶紧抢沙发哦!

我要评论

作者介绍

👨‍🏫葛继科,重庆科技大学计算机科学与工程学院(人工智能学院)院长助理,教授。主要从事人工智能、大数据应用、网络安全等方面的教学及研究工作。主讲课程包括“大数据平台与应用”“大数据分析与挖掘”“大数据采集与优化”“人工智能”“计算机网络”“网络安全技术”等。主持省部级教学质量工程项目1项,省部级教改重点项目2项、一般项目1项,教育部产学合作育人项目10项,校级教改项目4项,发表教改论文8篇。获省部级教学成果二等奖1项、校级教学成果二等奖2项。主持省部级科研项目10余项,参与国家级科研项目3项、省部级7项;发表学术论文50余篇,其中SCI收录7篇、EI收录20余篇、中文核心6篇,授权发明专利6项。主编《油田大数据应用技术》《量子人工智能引论》《大数据采集、预处理与可视化》《漫话深度学习》等著作。

相关图书

人邮微信
本地服务
教师服务
教师服务
读者服务
读者服务
返回顶部
返回顶部