我爱电子书-《Hadoop实战》| pdf + epub + mobi + awz3, 高清版, 带目录，Kindle版, 多看精排版下载

注重体验与质量的电子书资源下载网站

分类于: 计算机基础互联网云计算&大数据人工智能

简介

Hadoop实战豆 6.2分

资源最后更新于 2020-03-29 03:14:23

作者：陆嘉恒

出版社：出版社机械工业出版社华章公司

出版日期：2011-10

ISBN：9787111359449

文件格式： pdf

标签：计算机 IT 云计算 Hadoop 分布式计算机与互联网

简介· · · · · ·

本书是一本系统且极具实践指导意义的Hadoop工具书和参考书。内容全面，对Hadoop整个技术体系进行了全面的讲解，不仅包括HDFS和MapReduce这两大核心内容，而且还包括Hive、HBase、Mahout、Pig、ZooKeeper、Avro、Chukwa等与Hadoop相关的子项目的内容。实战性强，为各个知识点精心设计了大量经典的小案例，易于理解，可操作性强。全书一共18章：第1章全面介绍了Hadoop的概念、优势、项目结构、体系结构，以及它与分布式计算的关系；第2章详细讲解了Hadoop集群的安装和配置，以及常用的日志分析技巧；第3章分析了Hadoop在Yahoo！、eBay、Facebook和百度的应用案例，以及Hadoop平台上海量数据的排序；第4-7章深入地讲解了MapReduce计算模型、MapReduce应用的开发方法、MapReduce的工作机制，同时还列出了多个MapReduce的应用案例，涉及单词计数、数据去重、排序、单表关联和多表关联等内容；第8-11章全面地阐述了Hadoop的I/O操作、HDFS的原理与基本操作，以及Hadoop的各种管理操作，如集群的维护等；第12-17章详细而系统地讲解了Hive、HBase、Mahout、Pig、ZooKeeper、Avro、Chukwa等所有与Hadoop相关的子项目的原理及使用，以及这些子项目与Hadoop的整合使用；第18章以实例的方式讲解了常用Hadoop插件的使用和Hadoop插件的开发。陆嘉恒，中国人民大学副教授，新加坡国立大学博士，美国加利福尼亚大学尔湾分校(University of California, Irvine) 博士后。专注于云计算及其相关技术的研究，对Hadoop有较深入的研究，积累了丰富的实践经验。对分布式计算和海量数据处理有深刻的认识，主持并完成了多个国家863和自然科学基金项目的研究与实施。2009年入选新世纪优秀人才，2010年入选北京科技新星。主持《云计算概论》课程获教育部-IBM精品课程称号。

直接下载

简介

Hadoop实战 豆 6.2分

简介· · · · · ·

目录

Hadoop实战

前言

第1章 Hadoop简介

1.1 什么是Hadoop

1.1.1 Hadoop概述

1.1.2 Hadoop的历史

1.1.3 Hadoop的功能与作用

1.1.4 Hadoop的优势

1.1.5 Hadoop的应用现状和发展趋势

1.2 Hadoop项目及其结构

1.3 Hadoop的体系结构

1.3.1 HDFS的体系结构

1.3.2 MapReduce的体系结构

1.4 Hadoop与分布式开发

1.5 Hadoop计算模型—MapReduce

1.6 Hadoop的数据管理

1.6.1 HDFS的数据管理

1.6.2 HBase的数据管理

1.6.3 Hive的数据管理

1.7 小结

第2章 Hadoop的安装与配置

2.1 在Linux上安装与配置Hadoop

2.1.1 安装JDK 1.6

2.1.2 配置SSH免密码登录

2.1.3 安装并运行Hadoop

2.2 在Windows上安装与配置Hadoop

2.2.1 安装Cygwin

2.2.2 配置环境变量

2.2.3 安装和启动sshd服务

2.2.4 配置SSH免密码登录

2.3 安装和配置Hadoop集群

2.3.1 网络拓扑

2.3.2 定义集群拓扑

2.3.3 建立和安装Cluster

2.4 日志分析及几个小技巧

2.5 小结

第3章 Hadoop应用案例分析

3.1 Hadoop在Yahoo！的应用

3.2 Hadoop在eBay的应用

3.3 Hadoop在百度的应用

3.4 Hadoop在Facebook的应用

3.5 Hadoop平台上的海量数据排序

3.6 小结

参考文献

第4章 MapReduce计算模型

4.1 为什么要用MapReduce

4.2 MapReduce计算模型

4.2.1 MapReduce Job

4.2.2 Hadoop中的Hello World程序

4.2.3 MapReduce的数据流和控制流

4.3 MapReduce任务的优化

4.4 Hadoop流

4.4.1 Hadoop流的工作原理

4.4.2 Hadoop流的命令

4.4.3 实战案例：添加Bash程序和Python程序到Hadoop流中

4.5 Hadoop Pipes

4.6 小结

第5章 开发MapReduce应用程序

5.1 系统参数的配置

5.2 配置开发环境

5.3 编写MapReduce程序

5.3.1 Map处理

5.3.2 Reduce处理

5.4 本地测试

5.5 运行MapReduce程序

5.5.1 打包

5.5.2 在本地模式下运行

5.5.3 在集群上运行

5.6 网络用户界面

5.6.1 JobTracker页面

5.6.2 工作页面

5.6.3 返回结果

5.6.4 任务页面

5.6.5 任务细节页面

5.7 性能调优

5.8 MapReduce工作流

Hadoop实战豆 6.2分

第5章开发MapReduce应用程序