题名:深入理解Hadoop
作者:(美) 萨米尔·瓦德卡, (美) 马杜·西德林埃, (美) 杰森·文纳著
出版年:2016
ISBN: 978-7-111-51565-4
分类号: TP274
中图分类: 数据处理、数据处理系统
译者: 于博, 冯傲风
定价: 56.00
页数: 384 页
出版社: 机械工业出版社
装订: 平装

本书作者基于对Hadoop系统的实践,深入浅出地对Hadoop进行了详细的讲解,包含大量的实例和技巧,可帮助有一定基础的开发者快速掌握分布式系统。主要内容包括:第1章~第4章讲解大数据系统的基本概念、Hadoop系统的关键概念,以及进行Hadoop平台管理的关键概念要素。第5章~第7章是本书的重点,深入分析了MapReduce框架,不仅包括MapReduce框架的API,还介绍MapReduce框架的更复杂概念及其设计理念。第8章~第14章介绍Hadoop生态系统,包括支持MapReduce程序的单元测试和集成测试框架、Hadoop系统的监控和日志系统、Hive框架、Pig和Crunch框架、HCatalog框架、Hadoop日志流处理、HBase等。第15章~第17章介绍了数据科学基本概念及应用、云计算实例、分布式下载服务实例等。