好程序员大数据学习路线分享Hadoop阶段的高可用配置
好程序员大数据学习路线分享Hadoop阶段的高可用配置,什么是Hadoop的HA机制Ha机制即Hadoop的高可用(7*24小时不中断服务)正式引入HA机制是从hadoop2.0开始,之前的版本中没有HA机制hadoop-ha严格来说应该分成各个组件的HA机制——HDFS的HA、YARN的HAHDFS的HA机制详解HDFS 的HA主要是通过双namenode协调工作实现双namenode协调工作的要点: A、元数据管理方式需要改变: 内存中各自保存一份元数据 Edits日志只能有一份,只有Active状态的namenode节点可以做写操作 两个namenode都可以读取edits 共享的edits放在一个共享存储中管理(qjournal和NFS两个主流实现) B、需要一个状态管理功能模块 实现了一个zkfailover,常驻在每一个namenode所在的节点 每一个zkfailover负责监控自己所在namenode节点,利用zk进行状态标识 当需要进行状态切换时,由zkfailover来负责切换 切换时需要防止brain split脑裂现象的发生 Namenode的运行原理两台服务器...