- 基于Hadoop与Spark的大数据开发实战
- 肖睿 丁科 吴刚山
- 341字
- 2020-06-25 18:39:59
内容提要
大数据技术让我们以一种前所未有的方式,对海量数据进行分析,从中获得有巨大价值的产品和服务,最终形成变革之力。本书围绕Hadoop和Spark两个主流大数据技术进行讲解,主要内容包括Hadoop环境配置、Hadoop分布式文件系统(HDFS)、Hadoop分布式计算框架Map Reduce、Hadoop资源调度框架YARN与Hadoop新特性、Hadoop分布式数据库HBase、数据仓库Hive、大数据离线处理辅助系统、Spark Core、Spark SQL、Spark Streaming等知识。
本书紧密结合实际应用,运用大量案例说明和实践,提炼含金量十足的开发经验。另外,本书配以多元的学习资源和支持服务,包括视频教程、案例素材下载、学习交流社区、讨论组等学习内容,为读者带来全方位的学习体验。
本书适合作为计算机、大数据相关专业的教材使用,也适合具有一定Linux、Java开发经验,并且想从事大数据开发的人员使用,也可作为大数据分析与运维人员的参考用书。