大数据技术栈思维导图.md
阅读全文
大数据应用常用打包方式
在提交大数据作业到集群上运行时,通常需要先将项目打成 JAR 包。这里以 Maven 为例,常用打包方式如下:
阅读全文
大数据常用软件安装指南
为方便大家查阅,本仓库所有软件的安装方式单独整理如下:
阅读全文
大数据学习路线
图片引用自 :https://www.edureka.co/blog/hadoop-ecosystem
阅读全文
虚拟机静态IP及多IP配置
添加如下网络配置:
阅读全文
基于Zookeeper搭建Kafka高可用集群
为保证集群高可用,Zookeeper 集群的节点数最好是奇数,最少有三个节点,所以这里搭建一个三个节点的集群。
阅读全文
基于ZooKeeper搭建Hadoop高可用集群
Hadoop 高可用 (High Availability) 分为 HDFS 高可用和 YARN 高可用,两者的实现基本类似,但 HDFS NameNode 对数据存储及其一致性的要求比 YARN ResourceManger 高得多,所以它的实现也更加复杂,故下面先进行讲解:
阅读全文
Zookeeper单机环境和集群环境搭建
下载对应版本 Zookeeper,这里我下载的版本 3.4.14。官方下载地址:https://archive.apache.org/dist/zookeeper/
阅读全文
Storm集群环境搭建
这里搭建一个 3 节点的 Storm 集群:三台主机上均部署 Supervisor 和 LogViewer 服务。同时为了保证高可用,除了在 hadoop001 上部署主 Nimbus 服务外,还在 hadoop002 上部署备用的 Nimbus 服务。Nimbus 服务由 Zookeeper 集群进行协调管理,如果
阅读全文
Storm单机版本环境搭建
you need to install Storm’s dependencies on Nimbus and the worker machines. These are:
阅读全文