高可用Hadoop平台－答疑篇

2016-04-18 582

1.概述

　　这篇博客不涉及到具体的编码，只是解答最近一些朋友心中的疑惑。最近，一些朋友和网友纷纷私密我，我总结了一下，疑问大致包含以下几点：

我学 Hadoop 后能从事什么岗位？
在遇到问题，我该如何去寻求解决方案？

　　针对以上问题，我在这里赘述下个人的经验，给即将步入 Hadoop 行业的同学做个参考。

2.我学 Hadoop 后能从事什么岗位

　　目前 Hadoop 相关的工作大致分为三类：应用，运维，二次开发

2.1 应用

　　这方面的主要工作是编写MapReduce作业，利用Hive之类的套件来进行数据分析或数据挖掘，Hadoop在这里只是一个基础平台，仍然是需要自己编写相应的逻辑去实现对应的业务。从事这方面的工作，你至少要懂一门编程语言，如Java，Shell，Python等。由于Hadoop的源码是用Java语言编写的，目前业界Java方面的Hadoop社区活跃度相对较高，Shell和Python对应的活跃度较少。目前培训机构都是在这方面进行培养的比较多，你只需要对Hadoop的框架构造，基本的组织结构有所了解，理解MapReduce的编程框架和模式，懂得代码调优，能够使用Hadoop的相关套件，如：Hive，Sqoop，Flume等。

2.2运维

　　这方面主要负责Hadoop集群的搭建，系统的各种参数的调优，集群故障处理和保持集群运行稳定，这部分人才目前市场上是较为奇缺的，也是很多在Hadoop平台相对成熟的企业所青睐的人才，对于从事这部分工作的人同学来说，他可以不懂Java语言，但是在工作上必须处事冷静，做事严谨认真。如果由较强的钻研精神，可以通过自己的在实际工作中摸索一些调优的解决方案。同样，也可以参加一些峰会，沙龙之类的互动活动与业界的一些牛人交流工作心得，从而来获取一些有价值的方案。另外一个能体现Hadoop运维价值的因素，遇到问题能够快速定位并找到解决方案，不过这部分的工作经验都是靠平时工作日积月累出来的，当然和你运维的集群规模大小也有一定关系，若你由机会进入到拥有大集群的公司进行这方面的工作，你的成长会很快，不单单是运维Hadoop。Hadoop运维这类工作是没法弄虚作假的，你想随便谷歌点资料去忽悠，很容易被识破。

2.3二次开发

　　从事这方面工作的要求较高，而且也不是所有的企业都设有这样的工作岗位，这部分的工作有：按照企业实际需求，对Hadoop的框架本身进行修改以适用于企业本身业务；研究版本的新特性；规划版本升级等等。这方面就需要你对Hadoop的源码进行深入了解学习和研究，时刻关注Hadoop官网及Hadoop社区，了解最新版本的特性，把握Hadoop未来的发展前景及房子方向。

　　但是并不是所有的企业将这些岗位划分的这么明细的，有些企业根本不涉及二次开发，一个Hadoop工程师同时负责开发和运维，所以，我们不仅要在Hadoop应用这块烂熟于心，而且，基本的Hadoop运维我们也必须要掌握，至少集群的搭建，基本的集群维护这些我们要会去做。

3.在遇到问题，我该如何去寻求解决方案

　　这个问题是很多初入Hadoop的同学会遇到的，在开发时遇到异常，或集群在运行时抛出一些异常，不知所措，下面我给出自己在实际工作中的一些心得体会。

　　一般抛出异常，log 文件都会有记录，这些问题很大一部分可能是你首次遇到，遇到问题我得先备份这些信息（log文件，异常操作记录）。然后，我们在仔细分析日志信息，若实在是没有解决思路，则可参考以下方案：

Google 关键字

　　这里给大家举个例子，异常信息如下所示：

java.io.ioexception could not obtain block blk_

　　这个异常信息我只截取了部分，我们首先到Google去搜索对应得关键字，如下图所示：

　　然后，Google会列出匹配到得或是相似得问题得结果，我们可以从中筛选出我们想要得结果。

Hadoop Jira

　　若是在Google后找不到想要得结果，可在Apache的官方Jira上查找关键字，这里有来自世界各地从事这方面的人，他们会把出现的这些现象做详细的描述，有的甚至会给出解决方案，和附上相应的patch。

　　部分 Comments 截图如下所示：

　　通过阅读评论，我们知道出现这种情况大多数是节点断开了，连接不上，原因找到后，我们就好去解决了。

源码

　　若以上两中方式都未能解决，查看源码，理解工作原理，初步猜测原因，调试验证。其实解决只是时间问题。如果你想深入了解，阅读官方的Jira，找到你感兴趣的问题去研究。绝对会有不一样的体验。

4.结束语

　　这篇答疑博客就和大家分享到这里，如果大家在研究的过程当中，有什么疑问可以加群进行讨论或发送邮件给我，我会尽我所能为您解答，与君共勉！

微信关注我们

原文链接：https://yq.aliyun.com/articles/31010

转载内容版权归作者及来源网站所有！

低调大师中文资讯倾力打造互联网数据资讯、行业资源、电子商务、移动互联网、网络营销平台。持续更新报道IT业界、互联网、市场资讯、驱动更新,是最及时权威的产业资讯及硬件资讯报道平台。

Hadoop2源码分析－Hadoop V2初识

1.概述在完成分析Hadoop2源码的准备工作后，我们进入到后续的源码学习阶段。本篇博客给大家分享，让大家对Hadoop V2有个初步认识，博客的目录内容如下所示： Hadoop的渊源 Hadoop V2部分项目图各个包的功能介绍本篇文章的源码是基于Hadoop-2.6.0来分析，其他版本的Hadoop的源码可以此作为参考分析。 2.Hadoop的渊源其实，早年Google的核心竞争力是它的计算平台，Google对外公布的论文有一下内容： GoogleCluster Chubby GFS BigTable MapReduce 可见MapReduce并不是Hadoop所独有的功能，之后Apache基金会得到类似的项目，这些项目有隶属于Hadoop项目，分别是： ZooKeeper（Chubby） HDFS（GFS） HBase（BigTable） MapReduce（Hadoop 这里是HDFS和MapReduce的统称）类似于这种思想的开源项目还有很多，如：Yahoo用Pig来处理巨大数据，Facebook用Hive来进行用户行为分析等。Hadoop的两大核心功能分别为HDF...

2016-04-19

657

1.概述今天这篇博客就是《高可用Hadoop平台》的尾声篇了，从搭建安装到入门运行 Hadoop 版的 HelloWorld（WordCount 可以称的上是 Hadoop 版的 HelloWorld ），在到开发中需要用到的各个套件以及对套件的安装使用，在到 Hadoop 的实战，一路走来我们对在Hadoop平台下开发的基本流程应该都熟悉了。今天我们来完成在高可用Hadoop平台开发的最后一步，导出数据。 2.导出数据目的首先，我来说明下为什么要导出数据，导出数据的目的是为了干嘛？我们都知道，我们当初统计这些数据的目标，就是为了来可视化这些数据结果；虽然结果我们是统计出来储存在 HDFS 上，但是，前段同学需要拿到这些数据，直接操作 HDFS 读取统计结果，这样的做法是不明智的，撇开安全性不说，时延就是一个很大的问题。所以，这里我们需要有一个步骤去完成数据的导出，将数据导出到 Mysql 之类的关系型数据库。这里我们用到的导出套件是Sqoop。 3.Sqoop 3.1安装包 sqoop下载地址 3.2配置打开配置环境文件： sudo vi /etc/profile 编辑 Sq...

2016-04-19

553

资源下载

更多资源

Mario

马里奥是站在游戏界顶峰的超人气多面角色。马里奥靠吃蘑菇成长，特征是大鼻子、头戴帽子、身穿背带裤，还留着胡子。与他的双胞胎兄弟路易基一起，长年担任任天堂的招牌角色。

腾讯云软件源

为解决软件依赖安装时官方源访问速度慢的问题，腾讯云为一些软件搭建了缓存服务。您可以通过使用腾讯云软件源站来提升依赖包的安装速度。为了方便用户自由搭建服务架构，目前腾讯云软件源站支持公网访问和内网访问。

Nacos

Nacos /nɑ:kəʊs/ 是 Dynamic Naming and Configuration Service 的首字母简称，一个易于构建 AI Agent 应用的动态服务发现、配置管理和AI智能体管理平台。Nacos 致力于帮助您发现、配置和管理微服务及AI智能体应用。Nacos 提供了一组简单易用的特性集，帮助您快速实现动态服务发现、服务配置、服务元数据、流量管理。Nacos 帮助您更敏捷和容易地构建、交付和管理微服务平台。

Spring

Spring框架（Spring Framework）是由Rod Johnson于2002年提出的开源Java企业级应用框架，旨在通过使用JavaBean替代传统EJB实现方式降低企业级编程开发的复杂性。该框架基于简单性、可测试性和松耦合性设计理念，提供核心容器、应用上下文、数据访问集成等模块，支持整合Hibernate、Struts等第三方框架，其适用范围不仅限于服务器端开发，绝大多数Java应用均可从中受益。