HBase学习心得之HBase原理Java接口操作增删改查

2024-05-12 17:48

本文主要是介绍HBase学习心得之HBase原理Java接口操作增删改查,希望对大家解决编程问题提供一定的参考价值,需要的开发者们随着小编来一起学习吧!

HBase之伟大(总结)

  一:region是按大小分割的,每个表开始只有一个region。随着数据不断插入表,region会不断增大,增大到了某个阀值,HRegion就会等分成两个新的HRegion。

  二:HRegion是Hbase中分布式存储和负载均衡的最小单位,最小单位就表示不同的HRegion能分布在不同的HRegion Server上,但一个HRegion是不能拆分到多个Server上的。

  三:HRegion虽是分布式存储的最小单位,但并不是存储的最小单位。HRegion由一个或多个Store组成,每个Store保存一个Column Family。每个Store又由一个memstore和0至多个storeFile组成。

  四:HBase各个组成部分的作用

         1.Client

            包含访问HBase的接口,client维护着一些cache来加快对HBase的访问,比如region的位置信息。

         2.Zookeeper

            1.保证任何时刻,集群中只有一个master。

            2.存储所有的Region的寻址入口。(Client能够通过Zookeeper访问到Region Server)

            3.实时监控Region Sever状态,将Region Server的上线和下线信息能够实时通知Master。(心跳机制RPC)

            4.存储HBase的schema,包括有哪些table,每个table有哪些Column Family。

         3.Master

            1.为Region Server分配region。

            2.负责Region Server的负载均衡。

            3.发现失效的Region Server,并重新分配其上的region。

            4.HDFS的垃圾回收。

            5.处理schema更新请求。

         4.Region Server

            1.维护Master分配的region,处理对这些的region的I/O请求。

            2.负责切分这些运行过程中变得过大的region。

PS:

      Client访问HBase上的数据过程并不需要master的参与。(寻址访问Zookeeper和Region Server)master仅仅维护着table和region的元数据信息,负载很低。

 

Java接口操作HBase

package cn.hbase;

import java.util.ArrayList;
import java.util.List;
import org.apache.hadoop.conf.Configuration;
import org.apache.hadoop.hbase.HBaseConfiguration;
import org.apache.hadoop.hbase.HColumnDescriptor;
import org.apache.hadoop.hbase.HTableDescriptor;
import org.apache.hadoop.hbase.TableName;
import org.apache.hadoop.hbase.client.Delete;
import org.apache.hadoop.hbase.client.Get;
import org.apache.hadoop.hbase.client.HBaseAdmin;
import org.apache.hadoop.hbase.client.HTable;
import org.apache.hadoop.hbase.client.Put;
import org.apache.hadoop.hbase.client.Result;
import org.apache.hadoop.hbase.client.ResultScanner;
import org.apache.hadoop.hbase.client.Scan;
import org.apache.hadoop.hbase.util.Bytes;
import org.junit.Before;
import org.junit.Test;

public class HBaseDemo {

 private Configuration conf;

 /*
  * 在增删改查之前操作
  */
 @Before
 public void init() {
  conf = HBaseConfiguration.create();
  conf.set("hbase.zookeeper.quorum", "192.168.56.110");
 }

 public static void main(String[] args) throws Exception {
  Configuration conf = HBaseConfiguration.create();
  // 客户端连的zookeeper
  /*
   * zookeeper集群
   */
  // conf.set("hbase.zookeeper.quorum",
  // "centos1:2181,centos2:2181,centos3:2181");
  /*
   * zookeeper单节点集群(hadoop+zookeeper+hbase)
   */
  conf.set("hbase.zookeeper.quorum", "192.168.56.110");
  HBaseAdmin admin = new HBaseAdmin(conf);
  // 创建user表
  HTableDescriptor htd = new HTableDescriptor(TableName.valueOf("user"));
  // 增添列族
  HColumnDescriptor hcd_info = new HColumnDescriptor("info");
  HColumnDescriptor hcd_data = new HColumnDescriptor("data");
  // 增添列族属性
  // 3
  hcd_info.setMaxVersions(3);
  // 2
  htd.addFamily(hcd_data);
  htd.addFamily(hcd_info);
  // 1
  admin.createTable(htd);

  admin.close();
 }

 /*
  * 插入
  */
 @Test
 public void testPut() throws Exception {
  // 得到表对象
  HTable table = new HTable(conf, "user");
  // put对象
  Put put = new Put(Bytes.toBytes("rk0001"));
  // 增加列族。列名。值
  put.add(Bytes.toBytes("info"), Bytes.toBytes("name"),
    Bytes.toBytes("zhangsan"));
  put.add(Bytes.toBytes("info"), Bytes.toBytes("age"),
    Bytes.toBytes("120"));
  put.add(Bytes.toBytes("info"), Bytes.toBytes("money"),
    Bytes.toBytes(10000));
  table.put(put);
  table.close();
 }

 /*
  * 批量插入100万条
  */
 public void testPut2() throws Exception {
  // 得到表对象
  HTable table = new HTable(conf, "user");
  // put对象数组
  List<Put> list = new ArrayList<Put>(10000);
  for (int i = 0; i < 1000001; i++) {
   Put put = new Put(Bytes.toBytes("rk0001"));
   // 增加列族。列名。值
   put.add(Bytes.toBytes("info"), Bytes.toBytes("name"),
     Bytes.toBytes("zhangsan" + i));
   list.add(put);
   if (i % 10000 == 0) {
    // 每10000条提交一次
    table.put(list);
    list = new ArrayList<Put>(10000);
   }
  }
  table.put(list);
  table.close();
 }

 /*
  * 取数据
  */
 @Test
 public void testGet() throws Exception {
  HTable table = new HTable(conf, "user");
  Get get = new Get(Bytes.toBytes("rk0001"));
  Result result = table.get(get);
  // 由result对象读取
  String r = Bytes.toString(result.getValue(Bytes.toBytes("info"),
    Bytes.toBytes("name")));
  System.out.println(r);
  table.close();
 }

 /*
  * 取多个
  */
 @Test
 public void testGets() throws Exception {
  HTable table = new HTable(conf, "user");
  Scan scan = new Scan(Bytes.toBytes("rk0001"), Bytes.toBytes("rk0005")); // 包含前面不包含后面
  // 返回结果集
  ResultScanner scanner = table.getScanner(scan);
  for (Result result : scanner) {
   String r = Bytes.toString(result.getValue(Bytes.toBytes("info"),
     Bytes.toBytes("name")));
   System.out.println(r);
  }
  table.close();
 }

 /*
  * 删除
  */
 @Test
 public void testDel() throws Exception {
  HTable table = new HTable(conf, "user");
  Delete delete = new Delete(Bytes.toBytes("rk0001"));
  table.delete(delete);
  table.close();
 }
}

 

 

 

       

 

这篇关于HBase学习心得之HBase原理Java接口操作增删改查的文章就介绍到这儿,希望我们推荐的文章对编程师们有所帮助!



http://www.chinasem.cn/article/983319

相关文章

Spring Boot中WebSocket常用使用方法详解

《SpringBoot中WebSocket常用使用方法详解》本文从WebSocket的基础概念出发,详细介绍了SpringBoot集成WebSocket的步骤,并重点讲解了常用的使用方法,包括简单消... 目录一、WebSocket基础概念1.1 什么是WebSocket1.2 WebSocket与HTTP

SpringBoot+Docker+Graylog 如何让错误自动报警

《SpringBoot+Docker+Graylog如何让错误自动报警》SpringBoot默认使用SLF4J与Logback,支持多日志级别和配置方式,可输出到控制台、文件及远程服务器,集成ELK... 目录01 Spring Boot 默认日志框架解析02 Spring Boot 日志级别详解03 Sp

java中反射Reflection的4个作用详解

《java中反射Reflection的4个作用详解》反射Reflection是Java等编程语言中的一个重要特性,它允许程序在运行时进行自我检查和对内部成员(如字段、方法、类等)的操作,本文将详细介绍... 目录作用1、在运行时判断任意一个对象所属的类作用2、在运行时构造任意一个类的对象作用3、在运行时判断

java如何解压zip压缩包

《java如何解压zip压缩包》:本文主要介绍java如何解压zip压缩包问题,具有很好的参考价值,希望对大家有所帮助,如有错误或未考虑完全的地方,望不吝赐教... 目录Java解压zip压缩包实例代码结果如下总结java解压zip压缩包坐在旁边的小伙伴问我怎么用 java 将服务器上的压缩文件解压出来,

SpringBoot中SM2公钥加密、私钥解密的实现示例详解

《SpringBoot中SM2公钥加密、私钥解密的实现示例详解》本文介绍了如何在SpringBoot项目中实现SM2公钥加密和私钥解密的功能,通过使用Hutool库和BouncyCastle依赖,简化... 目录一、前言1、加密信息(示例)2、加密结果(示例)二、实现代码1、yml文件配置2、创建SM2工具

Spring WebFlux 与 WebClient 使用指南及最佳实践

《SpringWebFlux与WebClient使用指南及最佳实践》WebClient是SpringWebFlux模块提供的非阻塞、响应式HTTP客户端,基于ProjectReactor实现,... 目录Spring WebFlux 与 WebClient 使用指南1. WebClient 概述2. 核心依

Spring Boot @RestControllerAdvice全局异常处理最佳实践

《SpringBoot@RestControllerAdvice全局异常处理最佳实践》本文详解SpringBoot中通过@RestControllerAdvice实现全局异常处理,强调代码复用、统... 目录前言一、为什么要使用全局异常处理?二、核心注解解析1. @RestControllerAdvice2

Spring IoC 容器的使用详解(最新整理)

《SpringIoC容器的使用详解(最新整理)》文章介绍了Spring框架中的应用分层思想与IoC容器原理,通过分层解耦业务逻辑、数据访问等模块,IoC容器利用@Component注解管理Bean... 目录1. 应用分层2. IoC 的介绍3. IoC 容器的使用3.1. bean 的存储3.2. 方法注

Spring事务传播机制最佳实践

《Spring事务传播机制最佳实践》Spring的事务传播机制为我们提供了优雅的解决方案,本文将带您深入理解这一机制,掌握不同场景下的最佳实践,感兴趣的朋友一起看看吧... 目录1. 什么是事务传播行为2. Spring支持的七种事务传播行为2.1 REQUIRED(默认)2.2 SUPPORTS2

怎样通过分析GC日志来定位Java进程的内存问题

《怎样通过分析GC日志来定位Java进程的内存问题》:本文主要介绍怎样通过分析GC日志来定位Java进程的内存问题,具有很好的参考价值,希望对大家有所帮助,如有错误或未考虑完全的地方,望不吝赐教... 目录一、GC 日志基础配置1. 启用详细 GC 日志2. 不同收集器的日志格式二、关键指标与分析维度1.