加载中...
扫一扫
下载苏宁易购APP
关注苏宁推客公众号
自购省钱·分享赚钱
下载苏宁金融APP
关注苏宁易购服务号
用户评价:----
物流时效:----
售后服务:----
实名认证领苏宁支付券立即领取 >
¥
提前抢
SUPER会员专享
由于此商品库存有限,请在下单后15分钟之内支付完成,手慢无哦!
欢迎光临本店铺
点我可查看更多商品哦~
100%刮中券,最高50元无敌券,券有效期7天
亲,今日还有0次刮奖机会
我的云钻:0
您的云钻暂时不足,攒足云钻再来刮
恭喜获得1张券!
今天的机会已经全部用完了,请明天再来
恭喜刮出两张券,请选择一张领取
活动自2017年6月2日上线,敬请关注云钻刮券活动规则更新。
如活动受政府机关指令需要停止举办的,或活动遭受严重网络攻击需暂停举办的,或者系统故障导致的其它意外问题,苏宁无需为此承担赔偿或者进行补偿。
醉染图书Hadoop构建数据仓库实践9787302469803
¥ ×1
商品
服务
物流
章 数据仓库简介1.1 什么是数据仓库 11.1.1 数据仓库的定义 11.1.2 建立数据仓库的原因 31.2 操作型系统与分析型系统 51.2.1 操作型系统 51.2.2 分析型系统 81.. 操作型系统和分析型系统对比 91.3 数据仓库架构 101.3.1 基本架构 101.3.2 主要数据仓库架构 121.3.3 操作数据存储 161.4 抽取-转换-装载 171.4.1 数据抽取 171.4.2 数据转换 191.4.3 数据装载 201.4.4 开发ETL系统的方法 211.4.5 常见ETL工具 211.5 数据仓库需求 221.5.1 基本需求 221.5.2 数据需求 1.6 小结 24第2章 数据仓库设计基础2.1 关系数据模型 252.1.1 关系数据模型中的结构 252.1.2 关系完整 282.1.3 规范化 302.1.4 关系数据模型与数据仓库 332.2 维度数据模型 342.2.1 维度数据模型建模过程 352.2.2 维度规范化 362.. 维度数据模型的特点 372.2.4 星型模式 382.2.5 雪花模式 40. Data Vault模型 42..1 Data Vault模型简介 42..2 Data Vault模型的组成部分 43.. Data Vault模型的特点 44..4 Data Vault模型的构建 44..5 Data Vault模型实例 462.4 数据集市 492.4.1 数据集市的概念 502.4.2 数据集市与数据仓库的区别 502.4.3 数据集市设计 502.5 数据仓库实施步骤 512.6 小结 54第3章 Hadoop生态圈与数据仓库3.1 大数据定义 553.2 Hadoop简介 563.2.1 Hadoop的构成 573.2.2 Hadoop的主要特点 583.. Hadoop架构 583.3 Hadoop基本组件 593.3.1 HDFS 603.3.2 MapReduce 653.3.3 YARN 723.4 Hadoop生态圈的组件 773.5 Hadoop与数据仓库 813.5.1 关系数据库的可扩展瓶颈 823.5.2 CAP理论 843.5.3 Hadoop数据仓库工具 853.6 小结 88第4章 安装Hadoop4.1 Hadoop主要发行版本 894.1.1 Cloudera Distribution for Hadoop(CDH) 894.1.2 Hortonworks Data Platform(HDP) 904.1.3 MapR Hadoop 904.2 安装Apache Hadoop 914.2.1 安装环境 914.2.2 安装前准备 924.. 安装配置Hadoop 934.2.4 安装后配置 974.2.5 初始化及运行 974.3 配置HDFS Federation 994.4 离线安装CDH及其所需的服务 1044.4.1 CDH安装概述 1044.4.2 安装环境 1064.4.3 安装配置 1064.4.4 Cloudera Manager许可管理 1144.5 小结 115第5章 Kettle与Hadoop5.1 Kettle概述 1175.2 Kettle连接Hadoop 1195.2.1 连接HDFS 1195.2.2 连接Hive 1245.3 导出导入Hadoop集群数据 1285.3.1 把数据从HDFS抽取到RDBMS 1285.3.2 向Hive表导入数据 1325.4 执行Hive的HiveL语句 1345.5 MapReduce转换示例 1355.6 Kettle提交Spark作业 1435.6.1 安装Spark 1435.6.2 配置Kettle向Spark集提作业 1465.7 小结 149第6章 建立数据仓库示例模型6.1 业务场景 1506.2 Hive相关配置 1526.2.1 选择文件格式 1526.2.2 支持行级更新 1596.. Hive事务支持的限制 1646.3 Hive表分类 1646.4 向Hive表装载数据 1696.5 建立数据库表 1746.6 装载日期维度数据 1796.7 小结 180第7章 数据抽取7.1 逻辑数据映 1827.2 数据抽取方式 1857.3 导出成文本文件 1917.4 分布式查询 1967.5 使用Sqoop抽取数据 2007.5.1 Sqoop简介 2007.5.2 CDH 5.7.0中的Sqoop 2037.5.3 使用Sqoop抽取数据 2037.5.4 Sqoop优化 2077.6 小结 208第8章 数据转换与装载8.1 数据清洗 2108.2 Hive简介 2148.2.1 Hive的体系结构 2158.2.2 Hive的工作流程 2168.. Hive服务器 2188.2.4 Hive客户端 2218.3 初始装载 18.4 定期装载 8.5 Hive优化 2468.6 小结 254第9章 定期自动执行ETL作业9.1 crontab 2569.2 Oozie简介 2609.2.1 Oozie的体系结构 2609.2.2 CDH 5.7.0中的Oozie 2629.3 建立定期装载工作流 2629.4 建立协调器作业定期自动执行工作流 2719.5 Oozie优化 2759.6 小结 2760章 维度表技术10.1 增加列 27810.2 维度子集 28510.3 角色扮演维度 29210.4 层次维度 29810.4.1 固定深度的层次 29910.4.2 递归 30210.4.3 多路径层次 31010.4.4 参差不齐的层次 31210.5 退化维度 31310.6 杂项维度 31610.7 维度合并 310.8 分段维度 32910.9 小结 3351章 事实表技术11.1 事实表概述 33611.2 周期快照 33711.3 累积快照 34311.4 无事实的事实表 34911.5 迟到的事实 35411.6 累积度量 36011.7 小结 3662章 联机分析处理12.1 联机分析处理简介 36712.1.1 概念 36712.1.2 分类 36812.1.3 能 37112.2 Impala简介 3711. Hive、SparkSL、Impala比较 3771..1 Spark SL简介 3771..2 Hive、Spark SL、Impala比较 3791.. Hive、Spark SL、Impala能对比 38212.4 联机分析处理实例 38712.5 Apache Kylin与OLAP 39912.5.1 Apache Kylin架构 39912.5.2 Apache Kylin安装 40112.6 小结 4073章 数据可视化13.1 数据可视化简介 40813.2 Hue简介 41013.2.1 Hue功能快速预览 41113.2.2 配置元数据存储 41213.3 Zeppelin简介 41513.3.1 Zeppelin架构 41513.3.2 Zeppelin安装配置 41613.3.3 在Zeppelin中添加MySL翻译器 42113.4 Hue、Zeppelin比较 42513.5 数据可视化实例 42613.6 小结 434
王雪迎,于中国地质大学计算机专业,不错,拥有20年数据库、数据仓库相关技术经验。曾先后供职于北京现代商业信息技术有限公司、北京在线九州信息技术服务有限公司、华北计算技术研究所、北京优贝在线网络科技有限公司,担任DBA、数据架构师等职位。
抢购价:¥ 38.00
易购价:¥ 38.00
注:参加抢购将不再享受其他优惠活动
亲,很抱歉,您购买的宝贝销售异常火爆,让小苏措手不及,请稍后再试~
验证码错误
看不清楚?换一张
确定关闭
亲,大宗购物请点击企业用户渠道>小苏的服务会更贴心!
亲,很抱歉,您购买的宝贝销售异常火爆让小苏措手不及,请稍后再试~
查看我的收藏夹
非常抱歉,您前期未参加预订活动,无法支付尾款哦!
关闭
抱歉,您暂无任性付资格
继续等待
0小时0分
立即开通
SUPER会员