Hbase 常用 Shell 命令

一、基本命令

打开 Hbase Shell:

  1. # hbase shell

1.1 获取帮助

  1. # 获取帮助
  2. help
  3. # 获取命令的详细信息
  4. help 'status'

1.2 查看服务器状态

  1. status

1.3 查看版本信息

  1. version

二、关于表的操作

2.1 查看所有表

  1. list

2.2 创建表

命令格式: create ‘表名称’, ‘列族名称 1’,’列族名称 2’,’列名称 N’

  1. # 创建一张名为Student的表,包含基本信息(baseInfo)、学校信息(schoolInfo)两个列族
  2. create 'Student','baseInfo','schoolInfo'

2.3 查看表的基本信息

命令格式:desc ‘表名’

  1. describe 'Student'

2.4 表的启用/禁用

enable 和 disable 可以启用/禁用这个表,is_enabled 和 is_disabled 来检查表是否被禁用

  1. # 禁用表
  2. disable 'Student'
  3. # 检查表是否被禁用
  4. is_disabled 'Student'
  5. # 启用表
  6. enable 'Student'
  7. # 检查表是否被启用
  8. is_enabled 'Student'

2.5 检查表是否存在

  1. exists 'Student'

2.6 删除表

  1. # 删除表前需要先禁用表
  2. disable 'Student'
  3. # 删除表
  4. drop 'Student'

三、增删改

3.1 添加列族

命令格式: alter ‘表名’, ‘列族名’

  1. alter 'Student', 'teacherInfo'

3.2 删除列族

命令格式:alter ‘表名’, {NAME => ‘列族名’, METHOD => ‘delete’}

  1. alter 'Student', {NAME => 'teacherInfo', METHOD => 'delete'}

3.3 更改列族存储版本的限制

默认情况下,列族只存储一个版本的数据,如果需要存储多个版本的数据,则需要修改列族的属性。修改后可通过 desc 命令查看。

  1. alter 'Student',{NAME=>'baseInfo',VERSIONS=>3}

3.4 插入数据

命令格式:put ‘表名’, ‘行键’,’列族:列’,’值’

注意:如果新增数据的行键值、列族名、列名与原有数据完全相同,则相当于更新操作

  1. put 'Student', 'rowkey1','baseInfo:name','tom'
  2. put 'Student', 'rowkey1','baseInfo:birthday','1990-01-09'
  3. put 'Student', 'rowkey1','baseInfo:age','29'
  4. put 'Student', 'rowkey1','schoolInfo:name','Havard'
  5. put 'Student', 'rowkey1','schoolInfo:localtion','Boston'
  6. put 'Student', 'rowkey2','baseInfo:name','jack'
  7. put 'Student', 'rowkey2','baseInfo:birthday','1998-08-22'
  8. put 'Student', 'rowkey2','baseInfo:age','21'
  9. put 'Student', 'rowkey2','schoolInfo:name','yale'
  10. put 'Student', 'rowkey2','schoolInfo:localtion','New Haven'
  11. put 'Student', 'rowkey3','baseInfo:name','maike'
  12. put 'Student', 'rowkey3','baseInfo:birthday','1995-01-22'
  13. put 'Student', 'rowkey3','baseInfo:age','24'
  14. put 'Student', 'rowkey3','schoolInfo:name','yale'
  15. put 'Student', 'rowkey3','schoolInfo:localtion','New Haven'
  16. put 'Student', 'wrowkey4','baseInfo:name','maike-jack'

3.5 获取指定行、指定行中的列族、列的信息

  1. # 获取指定行中所有列的数据信息
  2. get 'Student','rowkey3'
  3. # 获取指定行中指定列族下所有列的数据信息
  4. get 'Student','rowkey3','baseInfo'
  5. # 获取指定行中指定列的数据信息
  6. get 'Student','rowkey3','baseInfo:name'

3.6 删除指定行、指定行中的列

  1. # 删除指定行
  2. delete 'Student','rowkey3'
  3. # 删除指定行中指定列的数据
  4. delete 'Student','rowkey3','baseInfo:name'

四、查询

hbase 中访问数据有两种基本的方式:

  • 按指定 rowkey 获取数据:get 方法;

  • 按指定条件获取数据:scan 方法。

scan 可以设置 begin 和 end 参数来访问一个范围内所有的数据。get 本质上就是 begin 和 end 相等的一种特殊的 scan。

4.1Get查询

  1. # 获取指定行中所有列的数据信息
  2. get 'Student','rowkey3'
  3. # 获取指定行中指定列族下所有列的数据信息
  4. get 'Student','rowkey3','baseInfo'
  5. # 获取指定行中指定列的数据信息
  6. get 'Student','rowkey3','baseInfo:name'

4.2 查询整表数据

  1. scan 'Student'

4.3 查询指定列簇的数据

  1. scan 'Student', {COLUMN=>'baseInfo'}

4.4 条件查询

  1. # 查询指定列的数据
  2. scan 'Student', {COLUMNS=> 'baseInfo:birthday'}

除了列 (COLUMNS) 修饰词外,HBase 还支持 Limit(限制查询结果行数),STARTROWROWKEY 起始行,会先根据这个 key 定位到 region,再向后扫描)、STOPROW(结束行)、TIMERANGE(限定时间戳范围)、VERSIONS(版本数)、和 FILTER(按条件过滤行)等。

如下代表从 rowkey2 这个 rowkey 开始,查找下两个行的最新 3 个版本的 name 列的数据:

  1. scan 'Student', {COLUMNS=> 'baseInfo:name',STARTROW => 'rowkey2',STOPROW => 'wrowkey4',LIMIT=>2, VERSIONS=>3}

4.5 条件过滤

Filter 可以设定一系列条件来进行过滤。如我们要查询值等于 24 的所有数据:

  1. scan 'Student', FILTER=>"ValueFilter(=,'binary:24')"

值包含 yale 的所有数据:

  1. scan 'Student', FILTER=>"ValueFilter(=,'substring:yale')"

列名中的前缀为 birth 的:

  1. scan 'Student', FILTER=>"ColumnPrefixFilter('birth')"

FILTER 中支持多个过滤条件通过括号、AND 和 OR 进行组合:

  1. # 列名中的前缀为birth且列值中包含1998的数据
  2. scan 'Student', FILTER=>"ColumnPrefixFilter('birth') AND ValueFilter ValueFilter(=,'substring:1998')"

PrefixFilter 用于对 Rowkey 的前缀进行判断:

  1. scan 'Student', FILTER=>"PrefixFilter('wr')"