logo
分类于: 编程语言 云计算&大数据 其它 计算机基础

简介

Hadoop构建数据仓库实践 pdf高清扫描版

Hadoop构建数据仓库实践 pdf高清扫描版 8.7分

资源最后更新于 2020-03-30 19:36:41

作者:王雪迎

出版社:清华大学出版社

出版日期:2017-7

ISBN:9787302469803

文件格式: pdf

标签: 分布式 大数据

简介· · · · · ·

本书讲述在流行的大数据分布式存储和计算平台Hadoop上设计实现数据仓库,将传统数据仓库建模与SQL开发的简单性与大数据技术相结合,快速、高效地建立可扩展的数据仓库及其应用系统。本书内容包括数据仓库、Hadoop及其生态圈的相关概念,使用Sqoop从关系数据库全量或增量抽取数据,使用HIVE进行数据转换和装载处理,使用Oozie 调度作业周期性执行,使用lmpala进行快速联机数据分析,使用Hue将数据可视化,以及数据仓库中的渐变维(SCD)、代理键、角色扮演维度、层次维度、退化维度、无事实的事实表、迟到的事实、累积的度量等常见问题在Hadoop上的处理等。本书适合数据库管理员、大数据技术人员、Hadoop技术人员、数据仓库技术人员,也适合高等院校和培训机构相关专业的师生教学参考。

想要: 点击会收藏到你的 我的收藏,可以在这里查看

已收: 表示已经收藏

Tips: 注册一个用户 可以通过用户中心得到电子书更新的通知哦