我爱电子书-《Hadoop构建数据仓库实践》| pdf + epub + mobi + awz3, 高清版, 带目录，Kindle版, 多看精排版下载

注重体验与质量的电子书资源下载网站

分类于: 其它

简介

Hadoop构建数据仓库实践豆 8.7分

资源最后更新于 2020-03-20 17:46:20

作者：https://itpanda.net/book/280/download/276

出版社：出版社清华大学出版社

出版日期：2017-07

文件格式： epub, mobi, azw3

标签：互联网计算机编程设计限时特价数据

简介· · · · · ·

本书讲述在流行的大数据分布式存储和计算平台Hadoop上设计实现数据仓库，将传统数据仓库建模与SQL开发的简单性与大数据技术相结合，快速、高效地建立可扩展的数据仓库及其应用系统。本书内容包括数据仓库、Hadoop及其生态圈的相关概念，使用Sqoop从关系数据库全量或增量抽取数据，使用HIVE进行数据转换和装载处理，使用Oozie调度作业周期性执行，使用Impala进行快速联机数据分析，使用Hue将数据可视化，以及数据仓库中的渐变维（SCD）、代理键、角色扮演维度、层次维度、退化维度、无事实的事实表、迟到的事实、累积的度量等常见问题在Hadoop上的处理等。本书适合数据库管理员、大数据技术人员、Hadoop技术人员、数据仓库技术人员，也适合高等院校和培训机构相关专业的师生教学参考。王雪迎，毕业于中国地质大学计算机专业，高级工程师，拥有20年数据库、数据仓库相关技术经验。曾先后供职于北京现代商业信息技术有限公司、北京在线九州信息技术服务有限公司、华北计算技术研究所、北京优贝在线网络科技有限公司，担任DBA、数据架构师等职位。

存在版权问题，已经下架，暂时无法下载，请支持正版！

简介

Hadoop构建数据仓库实践 豆 8.7分

简介· · · · · ·

目录

作者简介

内容简介

前言

第1章 ◄数据仓库简介►

1.1 什么是数据仓库

1.1.1 数据仓库的定义

1.1.2 建立数据仓库的原因

1.2 操作型系统与分析型系统

1.2.1 操作型系统

1.2.2 分析型系统

1.2.3 操作型系统和分析型系统对比

1.3 数据仓库架构

1.3.1 基本架构

1.3.2 主要数据仓库架构

1.3.3 操作数据存储

1.4 抽取-转换-装载

1.4.1 数据抽取

1.4.2 数据转换

1.4.3 数据装载

1.4.4 开发ETL系统的方法

1.4.5 常见ETL工具

1.5 数据仓库需求

1.5.1 基本需求

1.5.2 数据需求

1.6 小结

第2章 ◄数据仓库设计基础►

2.1 关系数据模型

2.1.1 关系数据模型中的结构

2.1.2 关系完整性

2.1.3 规范化

2.1.4 关系数据模型与数据仓库

2.2 维度数据模型

2.2.1 维度数据模型建模过程

2.2.2 维度规范化

2.2.3 维度数据模型的特点

2.2.4 星型模式

2.2.5 雪花模式

2.3 Data Vault模型

2.3.1 Data Vault模型简介

2.3.2 Data Vault模型的组成部分

2.3.3 Data Vault模型的特点

2.3.4 Data Vault模型的构建

2.3.5 Data Vault模型实例

2.4 数据集市

2.4.1 数据集市的概念

2.4.2 数据集市与数据仓库的区别

2.4.3 数据集市设计

2.5 数据仓库实施步骤

2.6 小结

第3章 ◄Hadoop生态圈与数据仓库►

3.1 大数据定义

3.2 Hadoop简介

3.2.1 Hadoop的构成

3.2.2 Hadoop的主要特点

3.2.3 Hadoop架构

3.3 Hadoop基本组件

3.3.1 HDFS

3.3.2 MapReduce

3.3.3 YARN

3.4 Hadoop生态圈的其他组件

3.5 Hadoop与数据仓库

3.5.1 关系数据库的可扩展性瓶颈

3.5.2 CAP理论

3.5.3 Hadoop数据仓库工具

3.6 小结

第4章 ◄安装Hadoop►

4.1 Hadoop主要发行版本

4.1.1 Cloudera Distribution for Hadoop (CDH)

4.1.2 Hortonworks Data Platform (HDP)

4.1.3 MapR Hadoop

4.2 安装Apache Hadoop

4.2.1 安装环境

4.2.2 安装前准备

4.2.3 安装配置Hadoop

4.2.4 安装后配置

4.2.5 初始化及运行

Hadoop构建数据仓库实践豆 8.7分

1.1　什么是数据仓库

1.1.1　数据仓库的定义

1.1.2　建立数据仓库的原因

1.2　操作型系统与分析型系统

1.2.1　操作型系统

1.2.2　分析型系统

1.2.3　操作型系统和分析型系统对比

1.3　数据仓库架构

1.3.1　基本架构

1.3.2　主要数据仓库架构

1.3.3　操作数据存储

1.4　抽取-转换-装载

1.4.1　数据抽取

1.4.2　数据转换

1.4.3　数据装载

1.4.4　开发ETL系统的方法

1.4.5　常见ETL工具

1.5　数据仓库需求

1.5.1　基本需求

1.5.2　数据需求

1.6　小结

2.1　关系数据模型

2.1.1　关系数据模型中的结构

2.1.2　关系完整性

2.1.3　规范化

2.1.4　关系数据模型与数据仓库

2.2　维度数据模型

2.2.1　维度数据模型建模过程

2.2.2　维度规范化

2.2.3　维度数据模型的特点

2.2.4　星型模式

2.2.5　雪花模式

2.3　Data Vault模型

2.3.1　Data Vault模型简介

2.3.2　Data Vault模型的组成部分

2.3.3　Data Vault模型的特点

2.3.4　Data Vault模型的构建

2.3.5　Data Vault模型实例

2.4　数据集市

2.4.1　数据集市的概念

2.4.2　数据集市与数据仓库的区别

2.4.3　数据集市设计

2.5　数据仓库实施步骤

2.6　小结

3.1　大数据定义

3.2　Hadoop简介

3.2.1　Hadoop的构成

3.2.2　Hadoop的主要特点

3.2.3　Hadoop架构

3.3　Hadoop基本组件

3.3.1　HDFS

3.3.2　MapReduce

3.3.3　YARN

3.4　Hadoop生态圈的其他组件

3.5　Hadoop与数据仓库

3.5.1　关系数据库的可扩展性瓶颈

3.5.2　CAP理论

3.5.3　Hadoop数据仓库工具

3.6　小结

4.1　Hadoop主要发行版本

4.1.1　Cloudera Distribution for Hadoop (CDH)

4.1.2　Hortonworks Data Platform (HDP)

4.1.3　MapR Hadoop

4.2　安装Apache Hadoop

4.2.1　安装环境

4.2.2　安装前准备

4.2.3　安装配置Hadoop

4.2.4　安装后配置

4.2.5　初始化及运行

4.3　配置HDFS Federation

4.4　离线安装CDH及其所需的服务

4.4.1　CDH安装概述

4.4.2　安装环境

4.4.3　安装配置

4.4.4　Cloudera Manager许可证管理

4.5　小结

5.1　Kettle概述

5.2　Kettle连接Hadoop

5.2.1　连接HDFS