整理了一下最近图灵出版的大数据相关的书,有2本R语言+2本基于Python语言环境+1本Spark+1本数据清洗,最后还有一本大众阅读的经典好评畅销的数据分析。
1、示例讲解如何用R语言玩转数据——《R语言入门与实践》
作者:Garrett Grolemund
译者:冯凌秉
■ 将R编程所需的方方面面巧妙融合在三个精心挑选的示例中,助你轻松掌握R语言
■ 跟随世界一流的RStudio培训师掌握宝贵的编程技能
《R语言入门与实践》涵盖R语言编程的方方面面,内容涉及R对象的类型、R的记号体系和环境系统、自定义函数、if else语句、for循环、S3类、R的包系统以及调试工具等。本书还通过示例演示如何进行向量化编程,从而对代码进行提速并最大化地发挥R的潜能。
“如果你想跟世界一流的RStudio培训师学习R编程,却没有机会与其当面交流,那么这本书就是不二之选。读这本书于我而言是一种享受,希望你也有同感。”
——Hadley Wickham,RStudio首席科学家,《R包开发》(R Packages)作者
《R语言入门与实践》还没上市,预计6月上市。
2、一本全面而细致的R指南——《R语言实战(第2版)》
作者:Robert I. Kabacoff
译者:王小宁,刘撷芯,黄俊文
■ 用R轻松实现数据挖掘、数据可视化
■ 从实际数据分析出发,全面掌握R编程
■ 新增预测性分析、简化多变量数据等近200页内容
《R语言实战(第2版)》从解决实际问题入手,尽量跳脱统计学的理论阐述来讨论R语言及其应用,讲解清晰透澈,极具实用性。作者不仅高度概括了R语言的强大功能,展示了各种实用的统计示例,而且对于难以用传统方法分析的凌乱、不完整和非正态的数据也给出了完备的处理方法。第2版新增6章内容,涵盖时间序列、聚类分析、分类、高级编程、创建包和创建动态报告等,并分别详细介绍了如何使用ggplot2和lattice进行高级绘图。通读本书,你将全面掌握使用R语言进行数据分析、数据挖掘的技巧,领略大量探索和展示数据的图形功能,并学会如何撰写动态报告,从而更加高效地进行分析与沟通。
3、Google数据科学家作品——数据科学入门
作者:Joel Grus
译者:高蓉,韩波
■ 数据科学基本知识的重量级读本
《数据科学入门》基于易于理解且具有数据科学相关的丰富的库的Python语言环境,从零开始讲解数据科学工作。具体内容包括:Python速成,可视化数据,线性代数,统计,概率,假设与推断,梯度下降法,如何获取数据,k近邻法,朴素贝叶斯算法,等等。作者借助大量具体例子以及数据挖掘、统计学、机器学习等领域的重要概念,详细展示了什么是数据科学。书中涵盖的所有代码和数据都可以在GitHub上下载。
4、全面剖析网络数据采集技术——Python网络数据采集
作者:Ryan Mitchell
译者:陶俊杰,陈小莉
■ 用简单高效的Python语言,展示网络数据采集常用手段,剖析网络表单安全措施,完成大数据采集任务!
《Python网络数据采集》适合熟悉Python的程序员、安全专业人士、网络管理员阅读。书中不仅介绍了网络数据采集的基本原理,还深入探讨了更高级的主题,比如分析原始数据、用网络爬虫测试网站等。此外,书中还提供了详细的代码示例,以帮助你更好地理解书中的内容。
5、Spark实战指南——《Spark最佳实践》
作者:陈欢,林世飞
■ UCloud季昕华、Databricks连城,阿里胡熠,棒米科技武泽胜,腾讯肖磊\靳志辉\徐羽等联袂推荐!
■ 腾讯专家首次分享Spark最佳实践
■ 基于真实数据,用案例分析全面解读大数据应用设计
■ 腾讯资深研发者的Spark实践,揭秘广告和推荐系统核心技术
《Spark最佳实践》全书共分8章。前4章介绍Spark的部署、工作机制和内核,后4章分别通过实战项目介绍Spark SQL、Spark Streaming、Spark GraphX和Spark MLib功能模块。此外,本书详细介绍了常见的实战问题,比如大数据环境下的配置设置、程序调优等。本书附带的一键安装脚本,更能为初学者提供很大帮助。
6、数据清洗入门与实践——《干净的数据》
作者:Megan Squire
译者:任政委
■ 掌握高效数据清洗方法,为数据挖掘提供便利,让用户更好地体验大数据价值!
《干净的数据:数据清洗入门与实践》从文件格式、数据类型、字符编码等基本概念讲起,通过真实的示例,探讨如何提取和清洗关系型数据库、网页文件和PDF文档中的数据。最后提供了两个真实的项目,让读者将所有数据清洗技术付诸实践,完成整个数据科学过程。
7、精益系列丛书——《精益数据分析》
作者:Alistair Croll,Benjamin Yoskovitz
译者:韩知白,王鹤达
■ 《精益创业》作者埃里克·莱斯主编
《精益数据分析》围绕精益创业展开讨论,融合了精益创业法、客户开发、商业模式画布和敏捷/ 持续集成的精华。本书汇聚了100多位创始人、投资人、内部创业者和创新者的成功创业经验,呈现了30多个极具价值的案例分析,可以为各阶段的创业者提供行为准则。
网友评论
。行业做事决策的出谋划策。
理顺做事思考的瓶颈依赖于大数据,大数据成为企业和个人成長和发展工具学 ,词典,现代人必不可少的能力。