liunx下ETL(kettle)脚本定时任务(crontab)启动失败定位及解决

2024-05-24 23:18

本文主要是介绍liunx下ETL(kettle)脚本定时任务(crontab)启动失败定位及解决,希望对大家解决编程问题提供一定的参考价值,需要的开发者们随着小编来一起学习吧!

现象:

       最近项目有使用ETL工具kettle进行数据抽取更新,最终在服务器上执行时需要进行定时启动;通过crontab-e配置之后发现没有启动成功,由于只有子用户权限,没有root用户及sudo权限,经过一番排查及操作才得以解决,故记录下来;

原有步骤:

1.kettle脚本的编写

Date=`date +%Y%m%d%H%M%S`
/app/ETL/kettle/kitchen.sh -file=/app/ETL/work/test/test.kjb -logfile=/app/ETL/work/test/log/etl_${Date}.log

命名为start_job.sh;并授权整个/app/ETL/目录744权限,脚本编写过程中推荐使用绝对路径;

执行./start_job.sh运行正常且日志打印正常;

2.编写crontab -e

通过crontab -e编写定时任务:

00 15 * * * /bin/sh /app/ETL/work/test/start_job.sh

出现crontab: installing new crontab表示定时任务编写成功,但等待发现任务并没有执行;

原因定位:

1.由于环境集中管理,手上并没有root用户及sudo权限,无法查询crontab日志;

有权限的可以通过日志查看;crontab 日志路径如下:/var/log/cron

2.由于无日志,通过service crond status查看crontab运行状态正常,并配置测试定时任务:

00 16 * * * date >> /app/time.log

发现测试任务运行正常;

3.通过网上一番查找,定位原因:

 crontab有一个坏毛病,就是它总是不会缺省的从用户profile文件中读取环境变量参数,经常导致在手工执行某个脚本时是成功的,但是到crontab中试图让它定期执行时就是会出错。

如执行ETL这个脚本需要java_home变量,有可能你使用的这个用户的java版本与root不一致,或者root账户就没有安装java;

我这里就是root账户下的jdk是1.7但ETL需要的是1.8;

解决方法:

解决方法有两个:

1.在elk脚本中指定相关变量:

start_job.sh编写如下:

set ff=unix
#!/bin/bash
export JAVA_HOME=/app/jdk1.8.0_181
export JRE_HOME=${JAVA_HOME}/jre
export CLASSPATH=.:${JAVA_HOME}/lib:${JRE_HOME}/lib
export PATH=${JAVA_HOME}/bin:$PATH
Date=`date +%Y%m%d%H%M%S`
/app/ETL/kettle/kitchen.sh -file=/app/ETL/work/test/test.kjb -logfile=/app/ETL/work/test/log/etl_${Date}.log

2.在crontab -e指定当前用户配置文件:

55 01 * * * . ~/.bash_profile;/bin/sh /app/ETL/work/test/start_job.sh

 其中. ~/.bash_profile;就是表示当前用户的隐藏配置文件;

推荐使用第二种方式;

关联问题记录:

1.在编写start_job.sh脚本时会出现/bin/sh^M: bad interpreter错误,可通过脚本头部添加 set ff=unix解决

2.crontab -e生效后不是立即就可以执行,需要2-3分钟之后,所以测试时要注意配置的corn时间;

 

这篇关于liunx下ETL(kettle)脚本定时任务(crontab)启动失败定位及解决的文章就介绍到这儿,希望我们推荐的文章对编程师们有所帮助!



http://www.chinasem.cn/article/999811

相关文章

微信公众号脚本-获取热搜自动新建草稿并发布文章

《微信公众号脚本-获取热搜自动新建草稿并发布文章》本来想写一个自动化发布微信公众号的小绿书的脚本,但是微信公众号官网没有小绿书的接口,那就写一个获取热搜微信普通文章的脚本吧,:本文主要介绍微信公众... 目录介绍思路前期准备环境要求获取接口token获取热搜获取热搜数据下载热搜图片给图片加上标题文字上传图片

Spring事务中@Transactional注解不生效的原因分析与解决

《Spring事务中@Transactional注解不生效的原因分析与解决》在Spring框架中,@Transactional注解是管理数据库事务的核心方式,本文将深入分析事务自调用的底层原理,解释为... 目录1. 引言2. 事务自调用问题重现2.1 示例代码2.2 问题现象3. 为什么事务自调用会失效3

mysql出现ERROR 2003 (HY000): Can‘t connect to MySQL server on ‘localhost‘ (10061)的解决方法

《mysql出现ERROR2003(HY000):Can‘tconnecttoMySQLserveron‘localhost‘(10061)的解决方法》本文主要介绍了mysql出现... 目录前言:第一步:第二步:第三步:总结:前言:当你想通过命令窗口想打开mysql时候发现提http://www.cpp

Docker镜像pull失败两种解决办法小结

《Docker镜像pull失败两种解决办法小结》有时候我们在拉取Docker镜像的过程中会遇到一些问题,:本文主要介绍Docker镜像pull失败两种解决办法的相关资料,文中通过代码介绍的非常详细... 目录docker 镜像 pull 失败解决办法1DrQwWCocker 镜像 pull 失败解决方法2总

SpringBoot启动报错的11个高频问题排查与解决终极指南

《SpringBoot启动报错的11个高频问题排查与解决终极指南》这篇文章主要为大家详细介绍了SpringBoot启动报错的11个高频问题的排查与解决,文中的示例代码讲解详细,感兴趣的小伙伴可以了解一... 目录1. 依赖冲突:NoSuchMethodError 的终极解法2. Bean注入失败:No qu

Spring定时任务只执行一次的原因分析与解决方案

《Spring定时任务只执行一次的原因分析与解决方案》在使用Spring的@Scheduled定时任务时,你是否遇到过任务只执行一次,后续不再触发的情况?这种情况可能由多种原因导致,如未启用调度、线程... 目录1. 问题背景2. Spring定时任务的基本用法3. 为什么定时任务只执行一次?3.1 未启用

springboot报错Invalid bound statement (not found)的解决

《springboot报错Invalidboundstatement(notfound)的解决》本文主要介绍了springboot报错Invalidboundstatement(not... 目录一. 问题描述二.解决问题三. 添加配置项 四.其他的解决方案4.1 Mapper 接口与 XML 文件不匹配

Python中ModuleNotFoundError: No module named ‘timm’的错误解决

《Python中ModuleNotFoundError:Nomodulenamed‘timm’的错误解决》本文主要介绍了Python中ModuleNotFoundError:Nomodulen... 目录一、引言二、错误原因分析三、解决办法1.安装timm模块2. 检查python环境3. 解决安装路径问题

如何解决mysql出现Incorrect string value for column ‘表项‘ at row 1错误问题

《如何解决mysql出现Incorrectstringvalueforcolumn‘表项‘atrow1错误问题》:本文主要介绍如何解决mysql出现Incorrectstringv... 目录mysql出现Incorrect string value for column ‘表项‘ at row 1错误报错

如何解决Spring MVC中响应乱码问题

《如何解决SpringMVC中响应乱码问题》:本文主要介绍如何解决SpringMVC中响应乱码问题,具有很好的参考价值,希望对大家有所帮助,如有错误或未考虑完全的地方,望不吝赐教... 目录Spring MVC最新响应中乱码解决方式以前的解决办法这是比较通用的一种方法总结Spring MVC最新响应中乱码解