《大数据管理概论》一3.3　基于新型存储的大数据管理-低调大师

《大数据管理概论》一3.3　基于新型存储的大数据管理

2017-05-01 710

本节书摘来自华章出版社《大数据管理概论》一书中的第3章，第3.3节，作者孟小峰，更多章节内容可以访问云栖社区“华章计算机”公众号查看

3.3　基于新型存储的大数据管理

闪存、PCM等新型存储的物理特性、读写特性等均与磁盘有着显著的不同，而目前已有的大数据数据库，其设计理念均是基于磁盘存储，在面对闪存、PCM等新型存储时并不能最大限度发挥新型存储的性能。目前，在基于新型存储的大数据管理方面也有一些研究工作，包括大数据存储、大数据索引、大数据查询和大数据分析等。

3.3.1　存储管理

大数据存储通常采用分布式异构存储策略，但传统的分布式存储策略通常采用基于副本的方式。引入了多样化的新型存储介质后，需要设计新的数据分配算法，使数据分布在合适的新型存储介质上，从而加快数据的访问性能。
异构存储系统的特点在于采用了所谓的日志缓存（buffered

微信关注我们

原文链接：https://yq.aliyun.com/articles/89892

转载内容版权归作者及来源网站所有！

低调大师中文资讯倾力打造互联网数据资讯、行业资源、电子商务、移动互联网、网络营销平台。持续更新报道IT业界、互联网、市场资讯、驱动更新,是最及时权威的产业资讯及硬件资讯报道平台。

《Hadoop MapReduce实战手册》一1.3 写WordCountMapReduce示例程序，打包并使用独立的Hadoop运行它

本节书摘来异步社区《Hadoop MapReduce实战手册》一书中的第1章，第1.3节，作者：【美】Srinath Perera , Thilina Gunarathne 译者：杨卓荦责编：杨海玲，更多章节内容可以访问云栖社区“异步社区”公众号查看。 1.3 写WordCountMapReduce示例程序，打包并使用独立的Hadoop运行它 Hadoop MapReduce实战手册本节传授如何写一个简单的MapReduce程序，以及如何执行它，如图1-1所示。要运行MapReduce作业，用户需要提供一个map函数、一个reduce函数、输入数据，以及输出数据的位置。在执行时，Hadoop实际执行如下步骤。 Hadoop通过换行符将输入数据分解成多个数据项，并且在每一个数据项上运行一次map函数，将这个数据项作为对应map函数的输入。执行完成时，每个map函数输出一个或者多个键值对。 Hadoop收集所有map函数产生的键值对，并且通过键对它们进行排序，将具有相同值的键值对分成一组。对于每一个不同的键，Hadoop会运行一次reduce函数，该函数的输入是这个键和它所对应...

2017-05-01

589

本节书摘来自华章社区《Spark大数据分析实战》一书中的第2章，第2.2节远程调试Spark程序，作者高彦杰　倪亚宇，更多章节内容可以访问云栖社区“华章社区”公众号查看 2.2　远程调试Spark程序本地调试Spark程序和传统的调试单机的Java程序基本一致，读者可以参照原来的方式进行调试，关于单机调试本书暂不赘述。对于远程调试服务器上的Spark代码，首先请确保在服务器和本地的Spark版本一致。需要按前文介绍预先安装好JDK和Git。（1）编译Spark在服务器端和本地计算机下载Spark项目。通过下面的命令克隆一份Spark源码： git clone https:// github.com/apache/spark 然后针对指定的Hadoop版本进行编译： SPARK_HADOOP_VERSION=2.3.0 sbt/sbt

2017-05-01

693

资源下载

更多资源

Mario

马里奥是站在游戏界顶峰的超人气多面角色。马里奥靠吃蘑菇成长，特征是大鼻子、头戴帽子、身穿背带裤，还留着胡子。与他的双胞胎兄弟路易基一起，长年担任任天堂的招牌角色。

腾讯云软件源

为解决软件依赖安装时官方源访问速度慢的问题，腾讯云为一些软件搭建了缓存服务。您可以通过使用腾讯云软件源站来提升依赖包的安装速度。为了方便用户自由搭建服务架构，目前腾讯云软件源站支持公网访问和内网访问。

Rocky Linux

Rocky Linux（中文名：洛基）是由Gregory Kurtzer于2020年12月发起的企业级Linux发行版，作为CentOS稳定版停止维护后与RHEL（Red Hat Enterprise Linux）完全兼容的开源替代方案，由社区拥有并管理，支持x86_64、aarch64等架构。其通过重新编译RHEL源代码提供长期稳定性，采用模块化包装和SELinux安全架构，默认包含GNOME桌面环境及XFS文件系统，支持十年生命周期更新。

Sublime Text

Sublime Text具有漂亮的用户界面和强大的功能，例如代码缩略图，Python的插件，代码段等。还可自定义键绑定，菜单和工具栏。Sublime Text 的主要功能包括：拼写检查，书签，完整的 Python API ， Goto 功能，即时项目切换，多选择，多窗口等等。Sublime Text 是一个跨平台的编辑器，同时支持Windows、Linux、Mac OS X等操作系统。