Hadoop大数据平台实战(03)：Linux实战安装HBase，并保存数据-低调大师

Hadoop大数据平台实战(03)：Linux实战安装HBase，并保存数据

2019-04-06 843

Apache HBase开源免费的Hadoop数据库，使用Java开发的，是一个分布式，可扩展的NoSQL数据库。本文会详细介绍HBase原理、架构、新特性、Linux环境下的安装，安装模式，表创建，简单的CRUD操作。

1、HBase数据库介绍
HBase是开源NoSQL数据库，主要用于大数据平台。受启发于谷歌在2006年发表了一篇关于Big Table的论文。当我们需要对大数据进行随机，实时读/写访问时，可以使用Apache HBase。 HBase可以托管非常大的表 - 数十亿行X百万列，存储大规模不规则的数据集。
Apache HBase是一个开源的，分布式的，版本化的NoSQL非关系数据库，模仿Google的Bigtable数据库：Chang等人的结构化数据分布式存储系统。正如Bigtable利用Google文件系统提供

微信关注我们

原文链接：https://yq.aliyun.com/articles/697059

转载内容版权归作者及来源网站所有！

低调大师中文资讯倾力打造互联网数据资讯、行业资源、电子商务、移动互联网、网络营销平台。持续更新报道IT业界、互联网、市场资讯、驱动更新,是最及时权威的产业资讯及硬件资讯报道平台。

如何从根源上解决 HDFS 小文件问题

我们知道，HDFS 被设计成存储大规模的数据集，我们可以在 HDFS 上存储 TB 甚至 PB 级别的海量数据。而这些数据的元数据（比如文件由哪些块组成、这些块分别存储在哪些节点上）全部都是由 NameNode 节点维护，为了达到高效的访问， NameNode 在启动的时候会将这些元数据全部加载到内存中。而 HDFS 中的每一个文件、目录以及文件块，在 NameNode 内存都会有记录，每一条信息大约占用150字节的内存空间。由此可见，HDFS 上存在大量的小文件（这里说的小文件是指文件大小要比一个 HDFS 块大小(在 Hadoop1.x 的时候默认块大小64M，可以通过 dfs.blocksize 来设置；但是到了 Hadoop 2.x 的时候默认块大小为128MB了，可以通过 dfs.block.size 设置) 小得多的文

2019-04-06

816

【点击订阅HBase+Spark技术双周刊】近期线上直播 HBase中Coprocessor的介绍以及实际业务场景中的使用本期直播中，快手大数据高级研发工程师陈杨将讲解HBase coprocessor的原理以及使用场景，coprocessor整个流程实战，包括开发，加载，运行以及管理，并结合1、2分析coprocessor在rsgroup中的具体使用。 HBase源码解析 本期直播中，陆金所研发工程师米麒麟将帮助大家解析HBase Read读流程源码、HBase Write写流程源码以及HBase Flush & Compact流程源码。 Phoenix queryserver本期直播中，阿里数据库产品专家瑾谦将为大家解答三个问题，即：什么是Phoenix QueryServer？为什么要用QueryServer？怎样使用Qu

2019-04-07

890

资源下载

更多资源

Mario

马里奥是站在游戏界顶峰的超人气多面角色。马里奥靠吃蘑菇成长，特征是大鼻子、头戴帽子、身穿背带裤，还留着胡子。与他的双胞胎兄弟路易基一起，长年担任任天堂的招牌角色。

腾讯云软件源

为解决软件依赖安装时官方源访问速度慢的问题，腾讯云为一些软件搭建了缓存服务。您可以通过使用腾讯云软件源站来提升依赖包的安装速度。为了方便用户自由搭建服务架构，目前腾讯云软件源站支持公网访问和内网访问。

Nacos

Nacos /nɑ:kəʊs/ 是 Dynamic Naming and Configuration Service 的首字母简称，一个易于构建 AI Agent 应用的动态服务发现、配置管理和AI智能体管理平台。Nacos 致力于帮助您发现、配置和管理微服务及AI智能体应用。Nacos 提供了一组简单易用的特性集，帮助您快速实现动态服务发现、服务配置、服务元数据、流量管理。Nacos 帮助您更敏捷和容易地构建、交付和管理微服务平台。

Rocky Linux

Rocky Linux（中文名：洛基）是由Gregory Kurtzer于2020年12月发起的企业级Linux发行版，作为CentOS稳定版停止维护后与RHEL（Red Hat Enterprise Linux）完全兼容的开源替代方案，由社区拥有并管理，支持x86_64、aarch64等架构。其通过重新编译RHEL源代码提供长期稳定性，采用模块化包装和SELinux安全架构，默认包含GNOME桌面环境及XFS文件系统，支持十年生命周期更新。