Hadoop1.X中作业提交的事件模型

2016-12-19 676

1 概述

在hadoop1.X中作业提交到JobTracker时，用了非常典型的事件模型，将源码抽象一下。

2 监听者

1个监听接口：需要关注的行为

2个监听者：具体实现类

public interface Listener {

	/**
	 * 监听作业添加
	 * 
	 * @param job 作业对象
	 */
	public void jobAdded(Job job);

	/**
	 * 监听作业删除
	 * 
	 * @param job 作业对象
	 */
	public void jobDeleted(Job job);
}

/**
 * 作业初始化监听器
 * 
 * 源码中调用jobTracker的initJob方法
 * 
 */
public class EagerTaskInitializationListener implements Listener {

	public void jobAdded(Job job) {
		System.out.println("作业被添加:" + job.getName() + " 执行操作1........");
	}

	public void jobDeleted(Job job) {
		System.out.println("作业被删除:" + job.getName() + " 执行操作1........");

	}
}

/**
 * 排序监听器
 */
public class JobQueueJobInProgressListener implements Listener {

	public void jobAdded(Job job) {
		System.out.println("作业被添加:" + job.getName() + " 执行操作2........");
	}

	public void jobDeleted(Job job) {
		System.out.println("作业被删除:" + job.getName() + " 执行操作2........");
	}
}

3 调度器

1个抽象调度器

1个具体调度器

public abstract class TaskScheduler {
	protected TaskTrackerManager taskTrackerManager;

	public void setTaskTrackerManager(TaskTrackerManager taskTrackerManager) {
		// 该对象就是JobTracker对象
		this.taskTrackerManager = taskTrackerManager;
	}

	public void start() {

	}
}

public class JobQueueScheduler extends TaskScheduler {

	// 监听器1
	private EagerTaskInitializationListener jobInProgressListener1;

	// 监听器2
	private JobQueueJobInProgressListener jobInProgressListener2;

	/**
	 * 初始化并注册监听器
	 */
	public void start() {
		jobInProgressListener1 = new EagerTaskInitializationListener();
		jobInProgressListener2 = new JobQueueJobInProgressListener();

		// taskTrackerManager为父类中的对象，其实就是JobTracker
		taskTrackerManager.addJobInProgressListener(jobInProgressListener1);
		taskTrackerManager.addJobInProgressListener(jobInProgressListener2);
	}
}

4 Tacker相关

1个抽象作业类

1个添加监听者的接口

1具体JobTracker

public class Job {

	private String name;

	public String getName() {
		return name;
	}

	public void setName(String name) {
		this.name = name;
	}
}


public interface TaskTrackerManager {
	// 添加监听者
	public void addJobInProgressListener(Listener listener);
}

public class JobTracker implements TaskTrackerManager {

	// 调度器
	private TaskScheduler scheduler;

	// 所有监听者
	private List<Listener> jobInProgressListeners = new CopyOnWriteArrayList<Listener>();

	/**
	 * 启动时创建调度器
	 */
	public JobTracker() {
		scheduler = new JobQueueScheduler();
	}

	/**
	 * 启动JobTracker
	 */
	public void startTracker() {
		// 将自身对象传给调度器
		scheduler.setTaskTrackerManager(this);
		// 启动调度器
		scheduler.start();
	}

	/**
	 * 作业被添加。通知所有注册的监听器
	 * 
	 * @param job 作业对象
	 */
	public void addJob(Job job) {
		for (Listener listener : jobInProgressListeners) {
			listener.jobAdded(job);
		}
	}

	/**
	 * 作业被删除。通知所有注册的监听器
	 * 
	 * @param job 作业对象
	 */
	public void deleteJob(Job job) {
		for (Listener listener : jobInProgressListeners) {
			listener.jobDeleted(job);
		}
	}

	/**
	 * 添加监听器
	 */
	@Override
	public void addJobInProgressListener(Listener listener) {
		jobInProgressListeners.add(listener);
	}
}

5 测试

public class TestJobTracker {

	public static void main(String[] args) {
		// 初始化
		JobTracker jobTracker = new JobTracker();
		jobTracker.startTracker();
		
		// 添加作业
		Job job = new Job();
		job.setName("xy job");
		jobTracker.addJob(job);
		// 删除作业
		jobTracker.deleteJob(job);
	}
}

微信关注我们

原文链接：https://yq.aliyun.com/articles/67292

转载内容版权归作者及来源网站所有！

低调大师中文资讯倾力打造互联网数据资讯、行业资源、电子商务、移动互联网、网络营销平台。持续更新报道IT业界、互联网、市场资讯、驱动更新,是最及时权威的产业资讯及硬件资讯报道平台。

云享团——基于大数据开发套件的增量同步策略

免费开通大数据服务：https://www.aliyun.com/product/odps 转载自云享团因为近期遇到用户在做ETL操作导入数据到MaxCompute的时候，对如何设置数据同步策略有疑惑，所以今天第一波我们来聊一下数据的同步策略，根据数据的特性，看看哪些数据适合增量同步，哪些适合全量同步，又是如何实现的？请认真看完下面的介绍，这些问题都不是事儿。我们把需要同步的数据，根据数据写入后是否会发生变化分为：会变化的数据（人员表比如说，人员的状态会发生变化）和不会发生变化的数据（一般是日志数据）。针对这两种场景，我们需要设计不同的同步策略。这里以把业务RDS数据库的数据同步到MaxCompute为例做一些说明，其他的数据源的道理是一样的。根据等幂性原则（也就是说一个任务，多次运行的结果是一样的，这样才能支持重跑调度。如果任务出

2016-12-19

721

在前一篇文章中，我们已经搭建好了Hadoop的群集，接下来，我们就是需要基于这个Hadoop群集，搭建Spark的群集。由于前面已经做了大量的工作，所以接下来搭建Spark会简单很多。首先打开三个虚拟机，现在我们需要安装Scala，因为Spark是基于Scala开发的，所以需要安装Scala。在Ubuntu下安装Scala很简单，我们只需要运行 sudo apt-get install scala 就可以安装Scala了。安装完成后运行scala -version可以看到安装的Scala的版本，我现在2.11版，安装目录是在/usr/share/scala-2.11 。接下来下载Spark。到官方网站，找到最新版的Spark的下载地址，选择Hadoop版本， http://spark.apache.org/downloads.html wget http://spark下载地址当下载完毕后解压文件： tar xvf spark-2.0.2-bin-hadoop2.7.tgz 接下来我们需要将解压的文件夹移动到指定目录，因为之前我们Hadoop安装到/usr/local/hado...

2016-12-19

712

资源下载

更多资源

Mario

马里奥是站在游戏界顶峰的超人气多面角色。马里奥靠吃蘑菇成长，特征是大鼻子、头戴帽子、身穿背带裤，还留着胡子。与他的双胞胎兄弟路易基一起，长年担任任天堂的招牌角色。

腾讯云软件源

为解决软件依赖安装时官方源访问速度慢的问题，腾讯云为一些软件搭建了缓存服务。您可以通过使用腾讯云软件源站来提升依赖包的安装速度。为了方便用户自由搭建服务架构，目前腾讯云软件源站支持公网访问和内网访问。

Rocky Linux

Rocky Linux（中文名：洛基）是由Gregory Kurtzer于2020年12月发起的企业级Linux发行版，作为CentOS稳定版停止维护后与RHEL（Red Hat Enterprise Linux）完全兼容的开源替代方案，由社区拥有并管理，支持x86_64、aarch64等架构。其通过重新编译RHEL源代码提供长期稳定性，采用模块化包装和SELinux安全架构，默认包含GNOME桌面环境及XFS文件系统，支持十年生命周期更新。

Sublime Text

Sublime Text具有漂亮的用户界面和强大的功能，例如代码缩略图，Python的插件，代码段等。还可自定义键绑定，菜单和工具栏。Sublime Text 的主要功能包括：拼写检查，书签，完整的 Python API ， Goto 功能，即时项目切换，多选择，多窗口等等。Sublime Text 是一个跨平台的编辑器，同时支持Windows、Linux、Mac OS X等操作系统。