返回首页
苏宁会员
购物车 0
易付宝
手机苏宁

服务体验

店铺评分与同行业相比

用户评价:----

物流时效:----

售后服务:----

  • 服务承诺: 正品保障
  • 公司名称:
  • 所 在 地:
本店所有商品

  • 醉染图书Hadoop大数据分析技术9787302620990
  • 正版全新
    • 作者: 迟殿委 陈鹏程著 | 迟殿委 陈鹏程编 | 迟殿委 陈鹏程译 | 迟殿委 陈鹏程绘
    • 出版社: 清华大学出版社
    • 出版时间:2022-11-01
    送至
  • 由""直接销售和发货,并提供售后服务
  • 加入购物车 购买电子书
    服务

    看了又看

    商品预定流程:

    查看大图
    /
    ×

    苏宁商家

    商家:
    醉染图书旗舰店
    联系:
    • 商品

    • 服务

    • 物流

    搜索店内商品

    商品分类

    商品参数
    • 作者: 迟殿委 陈鹏程著| 迟殿委 陈鹏程编| 迟殿委 陈鹏程译| 迟殿委 陈鹏程绘
    • 出版社:清华大学出版社
    • 出版时间:2022-11-01
    • 版次:1
    • 印次:1
    • 字数:418000
    • 页数:248
    • 开本:16开
    • ISBN:9787302620990
    • 版权提供:清华大学出版社
    • 作者:迟殿委 陈鹏程
    • 著:迟殿委 陈鹏程
    • 装帧:平装-胶订
    • 印次:1
    • 定价:69.00
    • ISBN:9787302620990
    • 出版社:清华大学出版社
    • 开本:16开
    • 印刷时间:暂无
    • 语种:暂无
    • 出版时间:2022-11-01
    • 页数:248
    • 外部编号:1202778352
    • 版次:1
    • 成品尺寸:暂无


    章 Hadoop概述与大数据环境准备 1
    1.1 大数据定义 2
    1.2 Hadoop生态介绍 2
    1.2.1 Hadoop简介 2
    1.2.2 Hadoop版本简介 4
    1.. Hadoop生态系统和组件介绍 6
    1.3 Hadoop 3新特 7
    1.4 虚拟机安装 9
    1.5 安装Linux操作系统 10
    1.6 SSH工具与使用 15
    1.7 Linux统一设置 16
    1.8 小结 18
    第2章 Hadoop伪分布式集群搭建 19
    2.1 安装独立运行的Hadop 9
    2.2 Hadoop伪分布式环境准备 22
    . Hadoop伪分布式安装 26
    2.4 HDFS操作命令 31
    2.5 Java项目访问HDFS 33
    2.5.1 创建Maven项目 34
    2.5.2 HDFS操作示例 36
    2.6 winutils 38
    2.7 快速MapReduce程序示例 39
    2.8 小结 42
    第3章 HDFS分布式存储实战 43
    3.1 HDFS的体系结构 43
    3.2 NameNode的工作 44
    3.2.1 查看镜像文件 45
    3.2.2 查看日志文件 46
    3.. 日志文件和镜像文件的操作过程 47
    3.3 SecondaryNameNode 49
    3.4 DataNode 50
    3.5 HDFS的命令 50
    3.6 远程过程调用 51
    3.7 小结 53
    第4章 MapReduce实战 55
    4.1 MapReduce的运算过程 55
    4.2 WordCount示例 57
    4.3 自定义Writable 60
    4.4 Partitioner分区编程 64
    4.5 自定义排序 66
    4.6 Combiner编程 67
    4.7 默认Mapper和默认Reducer 68
    4.8 倒排索引 69
    4.9 Shuffle 73
    4.10 小结 77
    第5章 ZooKeeper与高可用集群实战 79
    5.1 ZooKeeper简介 79
    5.1.1 Zxid 80
    5.1.2 版本号 81
    5.2 单一节点安装ZooKeeper 82
    5.3 基本客户端命令 83
    5.4 Java代码操作ZooKeeper 86
    5.5 ZooKeeper集群安装 91
    5.6 znode节点类型 92
    5.7 观察节点 93
    5.8 配置Hadoop高可用集群 93
    5.9 用Java代码操作集群 102
    5.10 小结 104
    第6章 Hive数据仓库实战 105
    6.1 Hive3的安装配置 107
    6.2 Hive的命令 110
    6.3 Hive内部表 114
    6.4 Hive外部表 116
    6.5 Hive表分区 117
    6.5.1 分区技术细节 117
    6.5.2 分区示例 119
    6.6 查询示例汇总 121
    6.7 Hive函数 122
    6.8 Hive自定义函数 128
    6.9 Hive视图 132
    6.10 hiveserver2 132
    6.11 使用JDBC连接hiveserver2 134
    6.12 小结 135
    第7章 HBase数据库实战 136
    7.1 HBase的特点 136
    7.2 HBase安装 139
    7.2.1 HBase的单节点安装 140
    7.2.2 HBase的伪分布式安装 142
    7.. Java客户端代码 144
    7.3 HBase集群安装 150
    7.4 HBase Shell操作 153
    7.4.1 数据模型定义 154
    7.4.2 数据基本操作 156
    7.5 协处理器 160
    7.6 Phoenix 162
    7.7 小结 168
    第8章 Flume数据采集实战 169
    8.1 Flume的安装与配置 170
    8.2 快速示例 171
    8.3 在ZooKeeper中保存Flume的配置文件 172
    8.4 Flume的更多Source 176
    8.4.1 Avro Source 176
    8.4.2 Thrift Source和Thrift Sink 180
    8.4.3 Exec Source 183
    8.4.4 Spool Source 184
    8.4.5 HDFS Sinks 184
    8.5 小结 185
    第9章 Kafka实战 186
    9.1 Kafka的特点 187
    9.2 Kafka术语 188
    9.3 Kafka安装与部署 189
    9.3.1 单机部署 189
    9.3.2 集群部署 195
    9.4 小结 198
    0章 影评大数据分析项目实战 199
    10.1 项目介绍 199
    10.2 项目需求分析 199
    10.3 项目详细实现 203
    10.3.1 搭建项目环境 203
    10.3.2 编写爬虫类 206
    10.3.3 编写分词类 207
    10.3.4 个job的Map阶段实现 210
    10.3.5 个job的Reducer阶段实现 210
    10.3.6 第二个job的Map阶段实现 211
    10.3.7 第二个job的自定义排序类阶段的实现 211
    10.3.8 第二个job的自定义分区阶段实现 212
    10.3.9 第二个job的Reduce阶段实现 212
    10.3.10 Run程序主类实现 213
    10.3.11 编写词云类 214
    10.3.12 效果测试 215
    1章 旅游酒店评价大数据分析项目实战 216
    11.1 项目介绍 216
    11.2 项目需求分析 217
    11.2.1 数据集需求 217
    11.2.2 功能需求 217
    11.3 项目详细实现 218
    11.3.1 数据集上传到HDFS 219
    11.3.2 Hadoop数据清洗 221
    11.3.3 构建Hive数据仓库表 225
    11.3.4 Sqoop数据导入与导出 0
    11.3.5 数据可视化开发 2


    【前言】


    迟殿委,计算机软件与理论专业硕士,于南昌大学,系统架构设计师。有多年企业软件研发经验和丰富的JavaEE培训经验,熟练掌握JavaEE全栈技术框架,对Java核心编程技术有深刻理解。主要擅长JavaEE系统架构设计、大数据分析与挖掘。



    本书系统讲解Hadoop生态圈各组件的核心知识、操作方法和分析技术,并通过两个综合实战项目——影评大数据分析、旅游酒店评价大数据分析,来贯穿Hadoop大数据分析的完整流程。


    【内容简介】


    伴随Hadoop的成长,Hadoop不再是一个简单的数据分布式存储平台和工具,已经成长为一个完整的生态圈。本书采用Hadoop 3.2.2版本,系统讲解Hadoop生态系统主流的大数据分析技术。本书配套示例源码、PPT课件、教学大纲与编程环境。 本书共分11章。内容包括Hadoop概述与大数据环境准备、Hadoop伪分布式集群搭建、HDFS分布式存储实战、MapReduce实战、ZooKeeper与高可用集群实战、Hive数据仓库实战、HBase数据库实战、Flume数据采集实战、Kafka实战、影评大数据分析项目实战、旅游酒店评价大数据分析项目实战。 本书可作为Hadoop大数据技术初学者的入门书,也可作为Hadoop大数据分析的指导手册,还可作为高等院校或者高职高专大数据专业的教材或教学参考书。


    售后保障

    最近浏览

    猜你喜欢

    该商品在当前城市正在进行 促销

    注:参加抢购将不再享受其他优惠活动

    x
    您已成功将商品加入收藏夹

    查看我的收藏夹

    确定

    非常抱歉,您前期未参加预订活动,
    无法支付尾款哦!

    关闭

    抱歉,您暂无任性付资格

    此时为正式期SUPER会员专享抢购期,普通会员暂不可抢购