kettle_Hbase

作者 : admin 本文共538个字,预计阅读时间需要2分钟 发布时间: 2024-06-10 共1人阅读

kettle_Hbase

☀Hbase学习笔记 

读取hdfs文件并将sal大于1000的数据保存到hbase

前置说明:

1.需要配置HadoopConnect 将集群中的/usr/local/soft/hbase-1.4.6/conf/hbase-site.xml复制至Kettle中的

Kettle\pdi-ce-8.2.0.0-342\data-integration\plugins\pentaho-big-data-plugin\hadoop-configurations\hdp26目录中

2.配置Hadoop Cluster 中Zookeeper的Hostname为master,port为2181

1、在HBase中创建一张people表

hbase(main):004:0> create 'people','info'

2、按下图建立流程图

kettle_Hbase插图

  • 文本文件输入

kettle_Hbase插图(1)

kettle_Hbase插图(2)

  • 设置过滤记录

kettle_Hbase插图(3)

  • 设置HBase output

    编辑hadoop连接,并配置zookeeper地址

kettle_Hbase插图(4)

kettle_Hbase插图(5)

  • 执行转换

kettle_Hbase插图(6)

  • 查看hbase people表的数据

    scan 'people'

    注意:若报错没有权限往hdfs写文件,在Spoon.bat中第119行添加参数

    “-DHADOOP_USER_NAME=root” “-Dfile.encoding=UTF-8”

本站无任何商业行为
个人在线分享 » kettle_Hbase
E-->