Hadoop大数据解决方案平台技术培训

讲师:刘晖 发布日期:12-31 浏览量:86

【课程目标】

Hadoop作为开源的云计算平台,为大数据处理提供了一整套解决方案,应用非常广泛。Hadoop作为一个平台框架,包括了如何存储海量数据,如何处理海量数据,以及相应的数据库、数据仓库、数据流处理、数据分析和挖掘算法库,等等。本课程主要介绍Hadoop的思想、原理,以及重要技术等相关知识。

通过本课程的学习,达到如下目的:

  1. 全面了解大数据处理技术的相关知识。
  2. 学习Hadoop的核心技术以及应用。
  3. 深入掌握Hadoop的相关工具在大数据中的使用。
  4. 掌握Hadoop的常用模块的工作原理及开发应用技术。
  5. 掌握传统数据中心向大数据中心转换的关键技术。
  6. 掌握海量数据处理的性能优化及维护技巧。

【授课时间】

2天时间

【授课对象】

网络部、大数据系统开发部、大数据中心、网络运维部等相关技术人员。

【授课方式】

原理精讲+案例演练+开发实践+系统优化

【课程大纲】

  1. Hadoop的基本框架
  2. 大数据时代面临的问题
  3. 当前解决大数据的技术方案
  4. Hadoop架构和云计算
  5. Hadoop简史及安装部署
  6. Hadoop设计理念和生态系统
  7. HDFS分布式文件系统--海量数据存储的摇篮
  8. HDFS的设计目标
  9. HDFS的基本架构
  1. HDFS的存储模型
  1. 多副本放置策略
  2. 多数据节点管理机制与交互过程
  3. 文件系统操作与管理
  1. 数据完整性机制
  1. 数据可靠性设计
  1. 其它
  1. 操作接口与编程接口

演练:HDFS文件操作命令

演练:HDFS编程示例

  1. MapReduce分布式计算系统--海量数据处理的利器
  2. MapReduce的三层设计理念
  1. MapReduce的基本架构
  1. MapReduce编程模型概述
  1. MapReduce作业调度机制
  1. 数据并行处理机制(五步骤)
  1. MapReduce容错机制
  1. MapReduce性能优化
  1. MapReduce操作接口

案例演练:MapReduce编程示例

  1. YARN:下一代通用资源管理系统
  1. HBase非关系型数据库--海量数据的黎明
  2. HBase的使用场景
  3. HBase的基本架构
  1. HBase的数据模型
  1. HBase的存储模型
  1. 数据分裂机制Split
  2. 数据合并机制Compaction
  1. HLog写前日志
  2. 数据库读写操作
  1. HBase操作接口
  1. HBase性能优化
  1. HBase集群监控与管理

案例演练:HBase命令操作实例

  1. Hive分布式数据仓库--高级的编程语言
  2. Hive是什么
  3. Hive与关系数据库的区别
  4. Hive系统架构
  1. Hive常用服务
  2. Hive元数据的三种部署模式
  3. Hive的命名空间
  4. Hive数据类型与存储格式
  1. Hive的数据模型
  1. HQL语言命令实例
  1. Hive自定义函数
  1. Hive性能优化

案例演练:Hive命令操作实例

  1. Sqoop数据交互工具--与传统数据库的桥梁
  2. Sqoop是什么
  3. Sqoop的架构和功能
  1. 数据双向交换
  1. 数据导入工具与命令介绍

案例演练:Sqoop数据导入/导出实际操作

  1. Pig数据流处理引擎--数据脚本语言
  2. Pig介绍
  3. 命令行交互工具Grunt
  4. Pig数据类型
  5. Pig Latin脚本语言介绍
  1. Pig Latin高级应用
  2. 开发与测试Pig Latin脚本
  1. 脚本性能优化
  2. 用户自定义函数UDF

案例演练:Pig Latin脚本编写、测试与运行操作

第八部分:Spark技术原理及应用

1、Spark基础知识

2、Spark生态系统

3、Spark运行架构

4、Spark的部署和应用方式

5、Spark编程实践

第九部分:hadoop各个组件之间的通信机制与关系

1、hadoop生态圈到底有多少组件?

2、hadoop各个组件之间的通信机制介绍

3、hadoop各个组件之间的相互关系

4、hadoop架构的应用案例解析

结束:课程总结与问题答疑。

 

 



分享
联系客服
返回顶部