hive 自定定义函数从hdfs中加载jar

hive 自定定义函数从hdfs中加载jar
1、编写函数
1. package com.example.hive.udf;
3. import org.apache.hadoop.hive.ql.exec.UDF;
4. import org.apache.hadoop.io.Text;
6. public final class LowerCase extends UDF {
7. public Text evaluate(final Text s) {
8. if (s == null) { return null; }
9. return new Text(s.toString().toLowerCase());
10. }
11. }
2、用eclipse下的fatjar插件进行打包

先下载net.sf.fjep.fatjar_0.0.31.jar插件包，cp至eclipse/plugins目录下，重启eclipse，右击项目选Export，选择用fatjar导出(可以删掉没用的包，不然导出的jar包很大)

3、将导出的hiveudf.jar复制到hdfs上

hadoop fs -copyFromLocal hiveudf.jar hiveudf.jar

4、进入hive，添加jar，

add jar hdfs://localhost:9000/user/root/hiveudf.jar

5、创建一个临时函数

create temporary function my_lower as 'com.example.hive.udf.LowerCase';

6、调用

select LowerCase(name) from teacher;

注：这种方法只能添加临时的函数，每次重新进入hive的时候都要再执行4-6，要使得这个函数永久生效，要将其注册到hive的函数列表

添加函数文件$HIVE_HOME/src/ql/src/java/org/apache/hadoop/hive/ql/udf/UDFLowerCase.java

修改$HIVE_HOME/src/ql/src/java/org/apache/hadoop/hive/ql/exec/FunctionRegistry.java文件

import org.apache.hadoop.hive.ql.udf.UDFLowerCase;

registerUDF(“LowerCase”, UDFLowerCase.class,false);

(上面这个方法未测试成功)

为了避免每次都有add jar 可以设置hive的'辅助jar路径'
在hive-env.sh中 export HIVE_AUX_JARS_PATH=/home/ckl/workspace/mudf/mudf_fat.jar;
相关阅读:
GUI编程基础
 MyBatisPlus详解
 MYSQL数据库优化（一）
设计模式遵循的原则
 MYSQL计算连续与不连续区间的方法
 CentOS安装MySQL5.7多实例步骤详解
 CentOS下安装Mysql 8.0步骤详解
 RDD和DataFrame和DataSet三者间的区别
 Spark读取Mysql，Redis，Hbase数据（一）
Spark中Broadcast的理解
原文地址：https://www.cnblogs.com/qyb-bk/p/6782198.html

hive 自定定义函数 从hdfs中加载jar

hive 自定定义函数从hdfs中加载jar