分布式数据库 Hbase 的高可用管理和监控（一）

　　HBase 作为 BigTable 的一个开源实现，随着其应用的普及，越来越被各大企业应用于海量数据系统中。本文将向读者简要介绍 Apache HBase 的基本知识，并展开介绍 IBM 对 HBase 的改进和扩展，HBase Master 多结点高可用支持，以及如何利用 IBM BigInsights 在 IBM Hadoop 集群中对 HBase 服务和作业提交进行监控和管理。本文将帮助读者在大数据云计算 Hadoop 集群应用中利用 HBase 更加高效、直观、便捷地进行存储，查询和优化海量数据。

　　Apache HBase 的基本知识

　　2006 年 11 月，Google 发表了一篇名为《 BigTable 》论文 , 2007 年 2 月，Hadoop 的开发人员对其进行实现并命名为 HBase。 HBase 是基于 Hadoop 之上的一种新型的基于列存储的开源数据存储架构，用于解决大数据问题，是 Hadoop 的分布式数据库。

　　HBase 现在已经比较成熟，最新的稳定版本是 0.94.x。HBase 已经被很多大公司采用，如 Facebook, Twitter，Adobe, Cloudera, IBM, 等等。HBase 不是传统 RDBMS 意义上的基于列的数据库，而是利用磁盘进行列存储格式的数据库，其优势在于提供基于关键字的特定列和顺序范围的快速访问。

　　HBase 有三个重要的组件：客户端库，一个 master server（可以配置多个备用 master，后文将对此进行详细描述）以及多个 Region Server。Master 负责分配 Region 到各个不同的 Region Server 上，Region Server 负责存储实际的数据。同时，HBase 通过使用 ZooKeeper，一种可靠，高可用，一致性的分布式协同服务来帮助其完成相应的任务。HBase 集群管理员可以通过在系统运行过程中添加和删除 Region Server 节点来调节改变工作负载。HBase 以 HFile 作为存储数据的基本格式，其底层的文件系统默认采用 HDFS。

　　图 1. HBases 基本架构

　　HBases 基本架构

　　图 1. 显示了不同的组件如 HDFS，Zookeeper 是怎样与 HBase 一起协调工作的。Master Server 负责处理跨 Region Server 的 regions 数据的导入平衡，卸载繁忙的 Region Server 负担，将 region 转移到更空余的 Region Server 上。

　　HBase Master 不负责实际的数据存储，它协调导入平衡，维护集群的状态，维护 schema 的更改和 metadata 元数据操作，如创建表和列族（column families），但从不提供任何数据服务。

　　Region servers 负责加载和维护 region，包括处理对其管理的 region 的所有读写请求，以及 region 大小增长到超过配置阀值的时候对其进行切分。

　　客户端通过与 Zookeeper 通信获取到其需要进行读写操作的 region 所在的 Region Server 之后，将直接与 Region Server 通信，并由 Region Server 处理所有相关的请求。

　　IBM BigInsights 架构中的 HBase

　　IBM Big Data（大数据）产品 InfoSphere BigInsights 是大数据管理与分析平台，其底层架构也采用了 Hadoop 和 HBase 对结构化和非结构化数据进行存储和查询。

　　BigInsightsz 集群软件层次中的 HBase

　　BigInsights 整合了很多已有的 Hadoop 开源组件，如 HDFS, MapReduce, HBase, Zookeeper 等，将它们很好的融入 BigInsights 软件体系，并与其他 BigInsights 的组件一起协同工作在同一个平台上。 HBase 被用作 BigInsights 的存储数据库，Zookeeper 被用作 BigInsights 的服务协同组件。如果要使用 HBase, 我们需要同时安装 Hadoop, Zookeeper, 因为 HBase 采用 Hadoop 作为其文件系统，采用 Zookeeper 作为其服务协同支持。

　　当把 BigInsights 部署到一个集群上时，软件层次的结构如图 2. 所示：

　　图 2. BigInsights 中 Hadoop 开源组件列表

　　BigInsights 中 Hadoop 开源组件列表

　　HBase 安装和配置

　　BigInsights 产品集成了经过 IBM JDK 编译和一定改进扩展后的 HBase。在 BigInsights 产品的安装过程中可以通过安装界面选择和配置 HBase, 配置内容包括指定 HBase 安装路径，日志目录，指定集群中 HBase Master 和 HBase Regionservers 节点以及服务端口。HBase 的二进制软件包默认安装和配置在 BigInsights 集群的所有节点上，也就是说安装完 BigInsights 以后的每个 BigInsights 节点都可以作为 HBase 的客户端使用。

　　在安装 BigInsights 之前，需要从解压以后的根目录下运行 start.sh 脚本，然后在浏览器中输入 URL http://your-server:8300/Install/ 打开安装向导，安装向导将引领您完成后续的安装步骤，安装过程将包括：安装类型（选择多节点分布式集群安装和配置）选择，文件系统选择，组，用户名及 SSH 配置，指定集群节点，组件安装，安全类型选择等，下面给出具体的 HBase 以及 Zookeeper 的安装配置实例。

　　配置内容配置信息

　　HBase master servers 指定 HBase Master 的节点名，可以是 IP，也可以是 hostname

　　HBase region servers 指定 HBase Regionserver 的节点名，可以是 IP，也可以是 hostname

　　Zookeeper mode 可选，有 shared/separate ZooKeeper 安装模式

　　HBase root directory 高级设置，默认为 /hbase( 可配置 )

　　HBase master port 60000( 可配置 )

　　HBase master UI port 60010( 可配置 )

　　HBase master server JMX port 10101( 可配置 )

　　HBase region server port 60020( 可配置 )

　　HBase region server UI port 60030( 可配置 )

　　HBase region server JMX port 10102( 可配置 )

　　图 3. HBase 安装和配置

　　HBase 安装和配置

　　图 4. Zookeeper 安装和配置

　　Zookeeper 安装和配置

　　最后，当安装完成以后，点击“Finish”或者在后台命令行运行“start.sh shutdown”关闭安装向导。

　　IBM 对 HBase 的改进和扩展

　　BigInsights 最大限度的提供了统一的，IBM 特有的 HBase 管理功能，包括用户界面以及后台命令行管理模式。这样，用户可以通过简单的界面操作或者后台命令来启停 / 查看 HBase 集群，而不用关心具体的实现细节。

　　与此同时，IBM 还提供了统一的用户界面和添加、删除节点命令来支持 HBase 集群的可伸缩性。

　　另外，HBase Master 多结点功能的实现，提供并保证了 HBase 在 BigInsights 中的高可用性。以下将对这些改进和扩展功能进行展开介绍。

　　IBM BigInsights 中的 HBase 集群管理和监控

　　BigInsights 集群为 HBase 提供了完备的管理功能，包括统一的 HBase 用户管理界面，后台命令行管理模式，HBase 服务状态监控，检查、同步、添加、删除、启动、停用、查看 HBase 服务，反向代理 UI，查看 HDFS 中的 HBase，HBase 应用程序提交等。

　　Web 界面管理 HBase 服务状态

　　通过 http:// 主节点主机名或 IP:8080/data/html/index.html 进入 BigInsights Web 管理控制台。使用 BigInsights 安装所有模块包括 Hadoop、Hbase、Zookeeper、Oozie、Flume 等。（注意：如果您使用的是 BigInsights Basic 版本，请使用 http:// 主节点主机名或 IP:8080/BigInsights 打开控制台。下文截图全部基于 Enterprise 版本，Basic 版本会略有差别。）

时间： 2024-09-28 22:40:19

分布式数据库 Hbase 的高可用管理和监控（一）的相关文章

分布式数据库 Hbase 的高可用管理和监控（二）

图 5. BigInsights Web 管理界面在 BigInsights Web 管理界面中点击"Cluster Status"页面,可以实现对 http://www.aliyun.com/zixun/aggregation/13713.html">HBase, Zookeeper 以及其他模块状态的监控.启停. "Cluster Status"页面左上方分别列出 BigInsights 集群中所有组件的服务的运行状态.可以看到所有服务目前都处

Hadoop白皮书(2)：分布式数据库HBase简介

HBase 是一个面向列的分布式数据库.HBase 不是一个关系型数据库,其设计目标是用来解决关系型数据库在处理海量数据时的理论和实现上的局限性.传统关系型数据库在上世纪七十年代为交易系统设计,以满足数据一致性 (ACID)为目标,并没有考虑数据规模扩大时的扩展性,以及单点系统失效时的可靠性.虽然经过多年的技术发展,产生了一些对关系性数据库的修补(并行数据库),然而受限于理论和实现上的约束,扩展性从来没有超过 40 个服务器节点.而 HBase 从一开始就是为 Terabyte 到Petabyt

什么是面向列开源分布式数据库Hbase - 产品和技术

什么是面向列开源分布式数据库Hbase 发布时间:2012.04.16 14:41 来源:和讯作者:和讯 HBase是一个分布式的.面向列的开源数据库,由Apache基金会开发.HBase不同于一般的关系数据库,它是一个适合于非结构化数据存储的数据库.它基于列的而不是基于行的模式.用户存储数据行在一个表里.一个数据行拥有一个可选择的键和任意数量的列.用户可根据键访问行,以及对于一系列的行进行扫描和过滤.HBase一个可以横向扩张的表存储系统,能够为大规模数据提供速度极快的低等

分布式数据库 HBase

http://www.aliyun.com/zixun/aggregation/13713.html">HBase – Hadoop Database,是一个高可靠性.高性能.面向列.可伸缩的分布式存储系统,利用HBase技术可在廉价PC Server上搭建起大规模结构化存储集群. HBase是Google Bigtable的开源实现,类似Google Bigtable利用GFS作为其文件存储系统,HBase利用Hadoop HDFS作为其文件存储系统:Google运行MapReduce来

分布式数据库HBase表设计

比较常用的数据库是关系型数据库,但很多场景下nosql数据库会更加擅长,从sql到nosql实施的第一步就是设计表结构,这是两种不同的思维方式,这里说下HBase表设计. 需求:需要一张stock表用于保存市场所有股票的分钟走向,即每个股票每分钟记录一次价格. 方案一:瘦表. 用stockId+datetime作为RowKey,这样方便通过stockId或datetime快速扫描获取到相关记录. RowKey ColumnFamily "stock_cf" stockId+dateti

高可用Hadoop平台－HBase集群搭建

1.概述今天补充一篇HBase集群的搭建,这个是高可用系列遗漏的一篇博客,今天抽时间补上,今天给大家介绍的主要内容目录如下所示: 基础软件的准备 HBase介绍 HBase集群搭建单点问题验证截图预览那么,接下来我们开始今天的HBase集群搭建学习. 2.基础软件的准备由于HBase的数据是存放在HDFS上的,所以我们在使用HBase时,确保Hadoop集群已搭建完成,并运行良好.若是为搭建Hadoop集群,请参考我写的<配置高可用的Hadoop平台>来完成Hadoop平台的搭建.另

数据库高可用实战：化繁为简搭建一套轻量级架构

作者介绍吴虞,SQL专家云团队成员,擅长解决SQL SERVER数据库性能.高可用.负载均衡等问题. 说到高可用,看官们会想到很多方案,也许是自亲身经历过系统从单机变成高可用的痛苦过程,也许有的看官只是在自己的虚机上搭建过测试的玩具.本文以我自己的真实经历给大家讲述,不管怎样,实战和测试玩耍还是很大区别的,可能你觉得搭建一套高可用方案很简单,配置下就OK了,但在真正的复杂系统中一切就没那么轻松了! 本文主要讲述升级并搭建AlwaysOn高可用的过程,以实施的思路为主.文中并没有搭建集

jeesz分布式架构-分布式高可用

版权声明:本文为博主原创文章,未经博主允许不得转载. 什么是高可用高可用HA(High Availability)是分布式系统架构设计中必须考虑的因素之一,它通常是指,通过设计减少系统不能提供服务的时间. 假设系统一直能够提供服务,我们说系统的可用性是100%. 如果系统每运行100个时间单位,会有1个时间单位无法提供服务,我们说系统的可用性是99%. 很多公司的高可用目标是4个9,也就是99.99%,这就意味着,系统的年停机时间为8.76个小时. 如何保障系统的高可用我们都知道,单点是系统

如何在阿里云上构建高可用应用

业务高可用是我们每个项目的需求,一个经常故障的项目,会让我们觉得不靠谱而选择放弃,从而导致项目的失败.今天,我们来聊一聊,如何让你自己的业务能够更加稳固的运行! 本次我们从四个不同的角度,来分析,如何让我们的应用更加稳固,平稳运行. 一. 程序架构优秀的代码优秀的代码非常重要,即使我们拥有最好的硬件资源和架构,如果我们没有一套健壮的代码,其他资源再好都没有用,所以代码在设计和编写时,应当注意代码的健壮程度.优秀的代码不止开发起来方便,同时维护成本也较低,对于后续的优化来说,健壮

猜你喜欢

msdn-我要学习mfc 和 Windows SDk 下面这些文档应该选哪个

问题描述我要学习mfc 和 Windows SDk 下面这些文档应该选哪个我要学习mfc 和 Windows SDk 下面这些文档应该选哪个在 vs2013的msdn 文档中解决方案如果硬盘空 ...

document.all还是document.getElementsByName

当页面上的控件同名且多个的时候,从程序的严密角度出发,需要判断长度,而且有长度和没长度是两种引用方法.oEle= document.all.aaa ;//这里有一个aaa的对象,但我们不知道它现在长度 ...

使Response窗口可以改变大小

response 1. 我们需要申明以下几个API函数: Function long SetWindowLongA(ulong hWnd, int nIndex, long dwNewLong) li ...

优化ACCESS提高速度

摘要这篇文章介绍了在设计.编写和实现Microsoft Access 数据库应用程序时为保证拥有最高速度而需要注意的几点. 介绍作为一名数据库程序员,你的主要任务是让你的用户能快速地选择. ...

C#中using关键字的使用

关键字 C#中可使用using关键字自动清除对象资源. # MyObject.cs using System; namespace MyProjects { public class MyObject ...

以惨痛经历告诫大家要注意关键词的选择

在刚做seo的时候,我的老师就曾经告诉我,做好seo的第一步,就是要确定好关键词的选择,然后才是其它的网站策划.布局,以及其它网站的一些因素.那个时候,不以为然,因为没有做站,而且做的站都是老师给一个 ...

Merlin的魔力: SpringLayout管理器

在 Java 布局管理器方面,最新增加了 SpringLayout 管理器,它是与 Java 1.4 一起发布的.这种布局管理器允许您将"spring"附加到组件上,这样组件就可以 ...

WPS怎么去除Word水印

WPS怎么去除Word水印第一步:首先利用WPS文字工具打开这份Word文档,然后在菜单中依次选择"视图→页眉页脚"命令. 第二步:接着把鼠标移动到水印 ...

酷盘使用时是否必须安装酷盘客户端

酷盘使用时不一定要安装酷盘客户端,可以随时通过酷盘网站m 上传下载文件.如果上传下载较大量的文件,推荐使用客户端,保证更快速稳定的传输.另外,如果希望在手机上使用酷盘,也可以安装酷盘客户端.

用Ps制作一张温馨的照片

制作一张温馨的照片,通过色彩的调整让一张照片赏心悦目,突出了照片中两人的心情,希望你能喜欢. 最终效果 1.创建一个新的文档,2100*1500像素,打开"风景"照片粘贴到画布上, ...

win XP虚拟模式失效的原因

Windows 7系统中带有XP虚拟模式,可以为用户提供Windows XP和Windows 7两种操作体验,既解决了旧版软件的兼容性问题,又能发挥Windows7系统的新特性. 一般来说,失效的原因 ...

WinPE的两种启动方式

WinPE是重装系统的必备工具了,但WinPE的相关基本知识你知道多少呢?下面就级大家补补课吧. 我们这次就先来说说WinPE的启动方式,目前来讲一般分为两种方式,包括普通启动方式和RAM启动方式 ...

联想Win7笔记本通过BIOS禁止开机声音步骤

我们都知道,任何系统开机都会自带声音,联想笔记本自然也不例外,有些用户不喜欢联想笔记本Win7系统自带的开机声音,想要将其关闭,那么该如何操作呢?其实通过BIOS界面就能关闭开机声音了. 1.开机 ...

wordpress不同页面侧边栏设置方法

中介交易 http://www.aliyun.com/zixun/aggregation/6858.html">SEO诊断淘宝客云主机技术大厅我们在wordpress主题开发过 ...

国外url编码-国外的URL编码方式与国内的URL编码方式有什么不同？

问题描述国外的URL编码方式与国内的URL编码方式有什么不同? 我最近做一个网站,在本地运行无误后发布到国外的服务器上运行时,有个特殊字符的链接不能识别,请问,这个的特殊字符让国外的服务器可以识别?

Oracle RAC (ASM)恢复案例（超大数据库)

前几天某客户的一个数据库出现故障,需要我们紧急救援支持.了解了一下环境,着实也吓了一跳,数据量55TB左右.首先我们来看看故障的信息: Fri Mar 25 22:57:10 2016 Error ...

ashx出现错误，帮忙看下这段代码并发的时候有没有问题

问题描述 try{answer=int.Parse(context.Request.Params["answer"].ToString());}catch{answer=0;}tr ...

Mirantis使用Kubernetes容器化OpenStack以缓解运维挑战

本文讲的是Mirantis使用Kubernetes容器化OpenStack以缓解运维挑战[编者的话]Swapnil是印度著名的记者和作家,其领域横跨Linux和开源软件.同时他也是印度有名的科幻作家. ...

ole-C/C++中用OLE操作Excel的问题，特别慢怎么提高效率啊

问题描述 C/C++中用OLE操作Excel的问题,特别慢怎么提高效率啊最近公司要求做一个小工具,就是两个Excel文档,父文档A和子文档B和进行匹配,如果一行数据A和B都有就在B中改该行的背景颜色 ...

Ransomware的斗士——云备份系统

了解你的敌人.在安全方面,最好知道人们为什么要攻击你,以及他们想要从攻击中得到什么.为了保护自己,就值得思考为什么ransomware的行为如此.在感染后击败ransomware的一种方法是在你的网络 ...

PostgreSQL IDE pgadmin , edb postgres enterprise manager 查询慢的问题分析

PostgreSQL 的GUI客户端比较多,有开源的,也有商业的.用得比较多的可能是PgAdmin了,有些人可能会用EDB的PEM.但实际上这两个GUI都有一个小问题,在返回较大的结果集时,会非常的慢 ...

消费者举报逃税获一元钱奖金感觉受辱起诉国税局

中广网洛阳9月25日消息(记者王娴)据中国之声<新闻纵横>报道,举报逃税,税务部门有奖,这个规定在很多地方都有,但最近,河南洛阳的一位举报人却因为这份奖励备受关注. 因为举报电脑商城不开发 ...

mysql数据库容灾实时备份主从

介绍: 随着互联网时代的发展数据对于一个企业来说越来越重要,各种安全策略进行备份,同步都应用而生,技术发展也逐渐走向成熟,虽然我们不能100%保证数据的安全,但是我们可以采用副本复制. ...

拿A轮并卡塔估值两亿SaaS电商ERP万里牛玩的什么？

聚焦:牛透社获悉,湖畔网络(杭州湖畔网络技术有限公司)--这家成立不足五年,专注SaaS化电商ERP产品的企业级服务公司于日前正式敲定引入数千万元投资,公司估值达到2亿,投资方为凯泰资本.此外,湖畔网 ...

css 问题 a 标签弱弱的问题

问题描述 css 问题 a 标签弱弱的问题 a:link{font-size:50px} a:visited{font-size:100px;color:yellow} 这个访问过后颜色变了但是 ...

Android ViewPager向导页面制作方法_Android

接着上一篇博客,上一篇博客跟大家分享了三种开始页面的定时跳转,根据项目需求接下来就说一下向导页面吧!几乎每一个APP都有自己的向导页面,一般都是第一次安装的时或者第一次进入应用时才有向导页面的,就是只 ...

RxJava操作符系列三（上）

RxJava操作符系列传送门 RxJava操作符源码 https://github.com/xiehui999/fuseProgram RxJava操作符系列一 RxJava操作符系列二前言在之前 ...

ant-Ant如何读取.xml文件内容

问题描述 Ant如何读取.xml文件内容 Ant如何读取.xml文件内容,求大神指点,谢谢!在官网看到了的信息不完整,没有能够成功读取,也可能是我写的方法有问题. 解决方案 http://my.osc ...

mysql查询周流失

问题描述前边提问说查周流失率,就是上周登录的人在本周没登录这样的一个人数.select count(1) from (select distinct playerId from log_login ...

Adecco调查24国1.7万求职者，迄今最全面研究报告，发布招聘、应聘新趋势

经历了漫长的复苏之路,终于在大衰退之后,经济开始反弹了.业务在增长,很多公司在招人,需要大量高质量的人才.对于有能力的职场人士来说,就业市场已经变得对他们有利.毕竟,专业人士无论在哪里都很抢手. 全球 ...

热搜