你将收获

完成全分布式的配置

实现经典案例wordcount

了解hadoop的工作机制

掌握Linux常用命令

适用人群

hadoop从业人员,大数据从业人员,程序爱好者,java程序员

课程介绍

Hadoop实现了一个分布式文件系统(Hadoop Distributed File System),简称HDFS。HDFS有高容错性的特点,并且设计用来部署在低廉的(low-cost)硬件上;而且它提供高吞吐量(high throughput)来访问应用程序的数据,适合那些有着超大数据集(large data set)的应用程序。HDFS放宽了(relax)POSIX的要求,可以以流的形式访问(streaming access)文件系统中的数据。本课程讲解搭建hadoop集群的全过程,从安装vmware,centos开始,从本地模式,伪分布式到全分布式,讲解实现经典案例wordcount结束,全方位讲解hadoop的操作细节,带你完成hadoop的安装和入门

课程目录

学员评价

5.0
  • 0%
  • 0%
  • 0%
  • 0%
  • 0%

正在加载中...

同学笔记

  • qq_35785890 2020-02-10 21:59:08

    来源:hadoop介绍 查看详情

    1、hadoop1.x,hadoop中的MAPreduce同时处理业务逻辑运算和资源的调度,耦合性较大,在hadoopx.x时代,增加了yarn。yarn只负责资源的调度,mapreduce只负责运算

    2、hadoop由分布式存储系统,mapreduce分布式计算,yarn资源调度组成。

没有更多了