R语言(第2版)
作者: 刘鹏、程显毅、孙丽丽、林道荣
出版社:清华大学出版社 2022-07-01
简介: 本书通过Titanic 数据分析案例,深入浅出地介绍了R 语言在大数据分析应用中的相关知识,包括:数据准备、数据清洗、数据探索、数据变换、特征工程、数据建模、模型评估、模型部署等。全书共13章,第1~3 章介绍R 语言的开发环境和基本语法;第4~8 章按数据分析生命周期讨论R语言的实现;第9 章高级编程相对独立,主要解决复杂问题可能用到的程序结构;第10、11 章与机器学习有关,内容偏难,但通过Rattle 包回避了算法底层技术的难点;第12、13 章通过两个实际项目,让读者体验数据处理的全过程以及业务对分析的重要性。本书力求以简洁、精练、理论与实践相结合的方式,让读者快速掌握R 语言。 本书既可作为数据分析相关课程的教材,也可作为数据分析爱好者的参考资料。