广告已过期!
详情 评论 声明
商品详情

资源名称:Hadoop硬实战 完整pdf


第1 部分 背景和基本原理
1 跳跃中的Hadoop
1.1 什么是Hadoop 
1.1.1 Hadoop 的核心组件
1.1.2 Hadoop 生态圈
1.1.3 物理架构
1.1.4 谁在使用Hadoop
1.1.5 Hadoop 的局限性
1.2 运行Hadoop 
1.2.1 下载并安装Hadoop
1.2.2 Hadoop 的配置
1.2.3 CLI 基本命令
1.2.4 运行MapReduce 作业 
1.3 本章小结

第2 部分 数据逻辑.
2 将数据导入导出Hadoop.
2.1 导入导出的关键要素
2.2 将数据导入Hadoop .
2.2.1 将日志文件导入Hadoop
技术点1 使用Flume 将系统日志文件导入HDFS 
2.2.2 导入导出半结构化和二进制文件
技术点2 自动复制文件到HDFS 的机制
技术点3 使用Oozie 定期执行数据导入活动 
2.2.3 从数据库中拉数据
技术点4 使用MapReduce 将数据导入数据库 
技术点5 使用Sqoop 从MySQL 导入数据 
2.2.4 HBase 
技术点6 HBase 导入HDFS 
技术点7 将HBase 作为MapReduce 的数据源
2.3 将数据导出Hadoop 
2.3.1 将数据导入本地文件系统
技术点8 自动复制HDFS 中的文件
2.3.2 数据库
技术点9 使用Sqoop 将数据导入MySQL
2.3.3 Hbase
技术点10 将数据从HDFS 导入HBase
技术点11 使用HBase 作为MapReduce 的数据接收器
2.4 本章小结
3 数据序列化――处理文本文件及其他格式的文件
3.1 了解MapReduce 中的输入和输出 
3.1.1 数据输入
3.1.2 数据输出
3.2 处理常见的序列化格式

..........


资源截图:

image.png


声明

1、链接失效请联系客服人员。
2、资源均来源于网友分享及网络公开发表文件,所有资料仅供学习交流。
3、如侵犯您的权益,请联系客服人员,我们将会在第一时间进行处理。

评论区

表情

共0条评论
  • 这篇文章还没有收到评论,赶紧来抢沙发吧~
相关推荐