?

大神自学后作《Python数据分析入门——从数据获取到可视化》

【数据猿导读】 本书作者沈祥壮,自学Python两年,以数据分析为主线,系统学习的数据的采集、处理、分析和可视化。

大神自学后作《Python数据分析入门——从数据获取到可视化》

本书为数据猿推出的《每周一本书》栏目丛书。

欢迎大家推荐好书给我们,让更多人受益。

这是一本务实之作,充分体现数据分析流程的各项环节,包含数据的采集、清洗和探索性分析,并通过大家耳熟能说的Python工具加以实操。更令人惊奇的是,本书的作者沈祥壮并非科班出身,他通过两年自学,系统掌握了数据的采集、处理、分析和可视化,真大神是也。

 大数据_数据可视化_python-1

内容简介

第1章主要讲解了在Ubuntu和Windows系统下,Python集成开发环境的搭建??悸堑匠跹д呷菀孜沧暗谌娇夥改?,又介绍了三种简单实用的方法来安装这些常见的库。接着对几个后面要用到的高级语法进行了简单介绍,为之后的应用打下基础。

第2章集中讲解了数据采集的流程,即网络爬虫程序的设计与实现。首先本章没有拘泥于使用Python的内置库urllib库进行实现,而是直接介绍了requests和其他更加简捷强大的库来完成程序的设计。在进阶内容中,对常见的编码问题、异常处理、代理IP、验证码、机器人协议、模拟登录,以及多线程等相关问题给出了解决的方案。

第3章讲解数据的清洗问题。在具体讲解清洗数据之前,先介绍了TXT、XLSX、JSON、CSV等各种文件的导入和导出的方法,并介绍了Python与MySQL数据库交互的方式。接着介绍了NumPy和pandas库的基本使用方法,这是我们用于数据处理和科学计算的两个强大的工具。最后综合以上的学习介绍了数据的去重、缺失值的填补等经典的数据清洗方法。

第4章首先讲解探索性数据分析的应用,并且简单介绍了机器学习基本知识。然后演示如何应用sklearn库提供的决策树和最邻近算法来处理分类问题,并尝试根据算法原理手动实现最邻近算法。最后介绍如何使用pandas、matplotlib和seaborn这三个库来实现数据的可视化。

第5章是综合性学习的章节,讲解了三个小项目的完整实现过程,旨在通过操作生活中真正的数据来强化前面基础内容的学习。

作者简介

沈祥壮,自学Python两年,以数据分析为主线,系统学习的数据的采集、处理、分析和可视化。在研究统计机器学习理论的同理,使用Python语言实现了部分统计学习算法。研究方向包括数据采集、数据挖掘、统计机器学习及图像处理。

目录

1  准备

1.1  开发环境搭建

1.2  Python基础语法介绍

1.3  The Zen of Python

2  数据的获取

2.1  爬虫简介

2.2  数据抓取实践

2.3  爬虫进阶

2.4  爬虫总结

3  数据的存取与清洗

3.1  数据存取

3.2  NumPy

3.3  pandas

3.4  数据的清洗

4  数据的分析及可视化

4.1  探索性数据分析

4.2  机器学习入门

4.3  手动实现KNN算法

4.4  数据可视化

5  Python与生活

5.1  定制一个新闻提醒服务

5.2  Python与数学

5.3  QQ群聊天记录数据分析

购买地址

京东:https://item.jd.com/12330816.html

当当://product.dangdang.com/25247679.html

亚马逊:https://www.amazon.cn/dp/B07BLJ8N33/ref=sr_1_1 ie=UTF8&qid=1527488436&sr=8-1&keywords=Python%E6%95%B0%E6%8D%AE%E5%88%86%E6%9E%90%E5%85%A5%E9%97%A8%E2%80%94%E2%80%94%E4%BB%8E%E6%95%B0%E6%8D%AE%E8%8E%B7%E5%8F%96%E5%88%B0%E5%8F%AF%E8%A7%86%E5%8C%96

作者邮箱[email protected]。

本书中使用的全部代码及相关数据已经托管至Github, 读者可以进入https://github.com/shenxiangzhuang/PythonDataAnalysis进行下载。


来源:数据猿

声明:数据猿尊重媒体行业规范,相关内容都会注明来源与作者;转载我们原创内容时,也请务必注明“来源:数据猿”与作者名称,否则将会受到数据猿追责。

刷新相关文章

旅游交通大数据——大众旅游时代的“富矿”
旅游交通大数据——大众旅游时代的“富矿”
大数据军演新疆展开:山东高速不停车交费
大数据军演新疆展开:山东高速不停车交费
2025年全球大数据规模将增长至163ZB,如何将数据世界变革为智能世界?
2025年全球大数据规模将增长至163ZB,如何将数据世界变革为智...

我要评论

精品栏目

[2017/12/19]

大数据24小时

More>

[2017/12/18-22]

大数据周周看

More>

[2017/12/18-22]

大数据投融资

More>

[2017/12/18-22]

大咖周语录

More>

[2017/12/13-20]

大数据周聘汇

More>

[2017/12/12-19]

每周一本书

More>

返回顶部
  • 你认日倭,人家可把你当猪啊。神马叫和我国有关?日本侵华是因当时中国自已的问题?你是日遗还是第二类? 2019-06-24
  • 人民电视--河北频道--人民网 2019-06-14
  • 全国“非遗”保护工作先进名单公布 2019-06-02
  • 韩国提东亚四国联合申办世界杯,中国足协:并无计划 2019-05-30
  • 回复@信马克.blog:啥叫公有制? 2019-05-30
  • 真的佩服你的语文,一个平台是什么肯定不知道,楼梯的台面肯定也不知道叫什么 2019-05-28
  • 山西“一减五增”特色兴农 2019-05-15
  • 真实的西南联大生活:抢着读书、打伞睡觉、八百人从军…… 2019-05-14
  • 以朝鲜民主主义人民共和国为例,难道特金会是由朝鲜工人、农民主导的?[哈哈] 2019-05-14
  • 【互动话题】一句话形容过完年的你 2019-05-13
  • 女性之声——全国妇联 2019-05-08
  • 土地是自然存在的地球的一部分,不是人类劳动成果,正如“深山老林”是自然存在的地球的一部分,不是人类劳动成果一样。懂吗? 2019-05-08
  • 全国政协委员、渭南市副市长高洁:讲好渭南故事 打造“一带一路”品牌城市 2019-05-08
  • 这样的帖子写主贴反驳,实在丢不起人! 2019-05-08
  • 全国唯一审定机收品种 “陕油28”油菜已推广36.7万亩 2019-05-04
  • 浙江十一选五开奖今天开奖结果 上海时时乐20191012019 云南快乐10分下载 湖南快乐十分动物下载 双色球蓝球走势图表 江苏十一选五遗漏记录 双色球中奖走势图 万博体育app 天尊 九龙六合彩 足彩4场进球开奖 排列三走势图500期走势图 广东快乐10分钟开奖结果 安徽11选5时时彩网 河南快三355最大遗漏