kettle从入门到精通 第七十六课 ETL之kettle kettle连接hive教程

1、群里有小伙伴询问kettle连接hive的demo,今天抽点时间整理下。其实kettle连接hive和连接mysql数据库也是一样的。

1)kettle中的lib目录下放hive驱动jar,这里我使用的是kyuubi-hive-jdbc-shaded-1.9.0.jar。

2)设置hive连接参数。

3)通过表输入进行读取数据。

2、下载kyuubi-hive-jdbc-shaded-1.9.0.jar,放到lib目录下面,记得重启kettle spoon。否则不生效

3、设置hive连接参数,我这里只设置了ip地址、数据库名称、端口信息。如下图所示:

4、拖动表输入到画布,写日志步骤进行打印读取数据。表输入步骤选择之前设置的hive连接,填写select语句。如下图所示:

5、点击运行按钮测试,数据可以正常获取。如下图所示:

6、删除kyuubi-hive-jdbc-shaded-1.9.0.jar,重新运行,出现找不到驱动jar错误,如下图所示。

kettle支持的其他数据源也是这个流程,欢迎小伙伴们留言探讨。

相关推荐
晴天彩虹雨12 小时前
统一调度与编排:构建自动化数据驱动平台
大数据·运维·数据仓库·自动化·big data·etl
白日与明月16 小时前
Hive-vscode-snippets
hive·hadoop·vscode
Sirius Wu16 小时前
Hive的窗口函数
数据仓库·hive·hadoop
シ風箏20 小时前
Hive【安装 01】hive-3.1.2版本安装配置(含 mysql-connector-java-5.1.47.jar 网盘资源)
java·hive·mysql
isNotNullX2 天前
数据集成难在哪?制造企业该怎么做?
大数据·数据库·数据仓库·人工智能·制造
Sirius Wu2 天前
一文说清楚Hive
数据仓库·hive·hadoop·后端
Sirius Wu2 天前
一文说清楚Hive中常用的聚合函数[collect_list]
hive·hadoop·list
zhangjin12222 天前
kettle插件-kettle数据挖掘ARFF插件
大数据·人工智能·数据挖掘·kettle·kettle教程·kettle数据挖掘插件
天翼云开发者社区3 天前
离线数仓优化简述
数据仓库
Leo.yuan3 天前
小白做投资测算,如何快速上手?
数据库·数据仓库·人工智能·算法·信息可视化