《Hadoop实战手册》一1.8 从MongoDB导入数据到HDFS
本节书摘来异步社区《Hadoop实战手册》一书中的第1章,第1.8节,作者: 【美】Jonathan R. Owens , Jon Lentz , Brian Femiano 译者: 傅杰 , 赵磊 , 卢学裕 责编: 杨海玲,更多章节内容可以访问云栖社区“异步社区”公众号查看。 1.8 从MongoDB导入数据到HDFS 本节将使用MongoInputFormat类加载MongoDB中的数据导入HDFS中。 准备工作使用Mongo Hadoop适配器最简单的方法是从GitHub上克隆Mongo-Hadoop工程,并且将该工程编译到一个特定的Hadoop版本。克隆该工程需要安装一个Git客户端。 本节假定你使用的Hadoop版本是CDH3。 Git客户端官方的下载地址是:http://git-scm.com/downloads。 在Windows操作系统上可以通过http://windows.github.com/访问GitHub。 在Mac操作系统上可以通过http://mac.github.com/访问GitHub。 可以通过https://github.com/mongodb/m...