Skip to content

大数据学习,从零开始学习大数据,包含大数据学习各阶段学习视频、面试资料

Notifications You must be signed in to change notification settings

bantao/BigDataGuide

 
 

Folders and files

NameName
Last commit message
Last commit date

Latest commit

 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 

Repository files navigation

大数据学习指南

大数据学习指南,从零开始学习大数据开发,包含大数据学习各个阶段资汇总

概述

  1.大数据简介
  2.大数据相关岗位介绍

大数据学习路线

  1.大数据学习路线(包含自己看过的视频链接)

完全分布式集群搭建

可以参考我的博客,按照顺序进行操作即可
  1.集群搭建

大数据框架组件

一、Hadoop

  1.Hadoop——分布式文件管理系统HDFS
  2.Hadoop——HDFS的Shell操作
  3.Hadoop——HDFS的Java API操作
  4.Hadoop——分布式计算框架MapReduce
  5.Hadoop——MapReduce案例
  6.Hadoop——资源调度器YARN
  7.Hadoop——Hadoop数据压缩

二、Zookeeper

  1.Zookeeper——Zookeeper概述

三、Hive

  1.Hive——Hive概述
  2.Hive——Hive数据类型

四、Flume

  1.Flume——Flume概述
  2.Flume——Flume实践操作
  3.Flume——Flume案例

五、Kafka

  1.Kafka——Kafka概述
  2.Kafka——Kafka深入解析
  3.Kafka——Kafka API操作实践

六、HBase

七、Spark

八、Flink

面试题

一、Hadoop

  1.Hadoop面试题总结(一)
  2.Hadoop面试题总结(二)——HDFS
  3.Hadoop面试题总结(三)——MapReduce
  4.Hadoop面试题总结(四)——YARN
  5.Hadoop面试题总结(五)——优化问题

二、Zookeeper

  1.Zookeeper面试题总结(一)

三、Hive

  1.Hive面试题总结(一)
  2.Hive面试题总结(二)

四、HBase

  1.HBase面试题总结(一)

五、Flume

  1.Flume面试题总结(一)

六、Kafka

  1.Kafka面试题总结(一)
  2.Kafka面试题总结(二)

七、Spark

  1.Spark面试题总结(一)
  2.Spark面试题总结(二)
  3.Spark面试题总结(三)
  4.Spark面试题总结(四)

Spark性能优化:
  5.Spark面试题总结(五)——几种常见的数据倾斜情况及调优方式
  6.Spark面试题总结(六)——Shuffle配置调优
  7.Spark面试题总结(七)——程序开发调优
  8.Spark面试题总结(八)——运行资源调优

交流群建好了,进群的小伙伴可以加我微信:MoRan1607,备注:GitHub

About

大数据学习,从零开始学习大数据,包含大数据学习各阶段学习视频、面试资料

Resources

Stars

Watchers

Forks

Releases

No releases published

Packages

No packages published

Languages

  • Java 100.0%