Linux alarm signal (SIGALRM) to detach process isAlive

2024-06-12 03:48

本文主要是介绍Linux alarm signal (SIGALRM) to detach process isAlive,希望对大家解决编程问题提供一定的参考价值,需要的开发者们随着小编来一起学习吧!

题记

最近做项目遇到的问题,程序跑了多个process,每个process都是相互独立的,为了解耦,类似于微服务的架构,我们要求系统可以detach 到 主线程跑飞,死循环等其他bug 问题,最初的设计方案是:每个process 都会给每一个monitor的process 去发送keep alive 消息,由monitor去收集每个module的keep alive消息,然后去判断是否process 跑飞等情况。但是这种方案,由于需要多一个monitor模块,在本来内存有限的嵌入式设备上,有点得不偿失,后来就想能否有linux 系统内部的 实现可以达到我们的要求,也就是 SIGALRM

1. Signal & Semaphore 区别

Signal: 是通过软中断信号通知进程发生了异步事件。进程之间可以通过系统调用kill 发送软中断信号,内核也可以因为内部事件而给进程发送信号,通知进程发生了某个事件。

Semaphore: 信号量是用来操作系统进程间同步访问共享资源。信号量在创建时需要设置一个初始值,表示同时可以有几个任务可以访问该信号量保护的共享资源,初始值为1就变成互斥锁(Mutex),即同时只能有一个任务可以访问信号量保护的共享资源。

2. SIGALRM 以及python code 实现
SIGALRM是在定时器终止时发送给进程的信号,在进行阻塞式系统调用时,为避免进程陷入无限的等待,可以为阻塞式系统调用设置定时器。
#include <unistd.h>
unsigned int alarm(unsigned int seconds);

在alarm成功调用后,开始计时,超过该事件将触发SIGALARM信号,然后会调到handler 执行。如下 是python的例子,

import signal,time,sys,thread,tracebackclass Example:def __init__(self):self.handler_counter = 0self.retry_counter = 3passdef timout_handler(self, signum, frame):'''timeout handler when failed to send signal alarmthere is a retry to make sure main thread hung'''self.handler_counter += 1print "call timeout_handler counter: " + str(self.handler_counter)if self.handler_counter == self.retry_counter:print("Have retry %s, exit process", self.retry_counter)traceback.print_stack(frame)  # print tracebacksys.exit()def monitor_alive(self, threadName, delay):'''monitor alive to send alarm message every (delay + 1) second, if after (delay + 1) doesn't receive response fromkernel, will interrupt timout_handler'''count = 0while True:time.sleep(delay)signal.alarm(delay + 1)print "sign_time count " + str(count)# below if logic to mock 3 time timeoutif count == 2:time.sleep(delay)if count == 4:time.sleep(delay)if count == 6:time.sleep(delay)count += 1print "%s: %s" % (threadName, time.ctime(time.time()))if __name__ == '__main__':example = Example()# register handler# only could set signal handler in main thread# https://stackoverflow.com/questions/44151888/why-only-main-thread-can-set-signal-handler-in-pythonsignal.signal(signal.SIGALRM, example.timout_handler)thread.start_new_thread(example.monitor_alive, ("Thread-1", 2,))while True:time.sleep(2)print('main thread ')

运行结果:

sign_time count 0
Thread-1: Sat Jun  9 10:52:43 2018
main thread 
sign_time count 1
Thread-1: Sat Jun  9 10:52:45 2018
main thread 
sign_time count 2
main thread 
Thread-1: Sat Jun  9 10:52:49 2018
main thread 
call timeout_handler counter: 1
main thread 
sign_time count 3
Thread-1: Sat Jun  9 10:52:51 2018
main thread 
sign_time count 4
main thread 
Thread-1: Sat Jun  9 10:52:55 2018
main thread 
call timeout_handler counter: 2
main thread 
sign_time count 5
Thread-1: Sat Jun  9 10:52:57 2018
main thread 
sign_time count 6
main thread 
Thread-1: Sat Jun  9 10:53:01 2018
main thread 
call timeout_handler counter: 3
('Have retry %s, exit process', 3)File "/home/odl/sereno/tests/singal.py", line 52, in <module>time.sleep(2)


这篇关于Linux alarm signal (SIGALRM) to detach process isAlive的文章就介绍到这儿,希望我们推荐的文章对编程师们有所帮助!



http://www.chinasem.cn/article/1053118

相关文章

linux-基础知识3

打包和压缩 zip 安装zip软件包 yum -y install zip unzip 压缩打包命令: zip -q -r -d -u 压缩包文件名 目录和文件名列表 -q:不显示命令执行过程-r:递归处理,打包各级子目录和文件-u:把文件增加/替换到压缩包中-d:从压缩包中删除指定的文件 解压:unzip 压缩包名 打包文件 把压缩包从服务器下载到本地 把压缩包上传到服务器(zip

Linux 网络编程 --- 应用层

一、自定义协议和序列化反序列化 代码: 序列化反序列化实现网络版本计算器 二、HTTP协议 1、谈两个简单的预备知识 https://www.baidu.com/ --- 域名 --- 域名解析 --- IP地址 http的端口号为80端口,https的端口号为443 url为统一资源定位符。CSDNhttps://mp.csdn.net/mp_blog/creation/editor

【Python编程】Linux创建虚拟环境并配置与notebook相连接

1.创建 使用 venv 创建虚拟环境。例如,在当前目录下创建一个名为 myenv 的虚拟环境: python3 -m venv myenv 2.激活 激活虚拟环境使其成为当前终端会话的活动环境。运行: source myenv/bin/activate 3.与notebook连接 在虚拟环境中,使用 pip 安装 Jupyter 和 ipykernel: pip instal

Linux_kernel驱动开发11

一、改回nfs方式挂载根文件系统         在产品将要上线之前,需要制作不同类型格式的根文件系统         在产品研发阶段,我们还是需要使用nfs的方式挂载根文件系统         优点:可以直接在上位机中修改文件系统内容,延长EMMC的寿命         【1】重启上位机nfs服务         sudo service nfs-kernel-server resta

【Linux 从基础到进阶】Ansible自动化运维工具使用

Ansible自动化运维工具使用 Ansible 是一款开源的自动化运维工具,采用无代理架构(agentless),基于 SSH 连接进行管理,具有简单易用、灵活强大、可扩展性高等特点。它广泛用于服务器管理、应用部署、配置管理等任务。本文将介绍 Ansible 的安装、基本使用方法及一些实际运维场景中的应用,旨在帮助运维人员快速上手并熟练运用 Ansible。 1. Ansible的核心概念

Linux服务器Java启动脚本

Linux服务器Java启动脚本 1、初版2、优化版本3、常用脚本仓库 本文章介绍了如何在Linux服务器上执行Java并启动jar包, 通常我们会使用nohup直接启动,但是还是需要手动停止然后再次启动, 那如何更优雅的在服务器上启动jar包呢,让我们一起探讨一下吧。 1、初版 第一个版本是常用的做法,直接使用nohup后台启动jar包, 并将日志输出到当前文件夹n

[Linux]:进程(下)

✨✨ 欢迎大家来到贝蒂大讲堂✨✨ 🎈🎈养成好习惯,先赞后看哦~🎈🎈 所属专栏:Linux学习 贝蒂的主页:Betty’s blog 1. 进程终止 1.1 进程退出的场景 进程退出只有以下三种情况: 代码运行完毕,结果正确。代码运行完毕,结果不正确。代码异常终止(进程崩溃)。 1.2 进程退出码 在编程中,我们通常认为main函数是代码的入口,但实际上它只是用户级

【Linux】应用层http协议

一、HTTP协议 1.1 简要介绍一下HTTP        我们在网络的应用层中可以自己定义协议,但是,已经有大佬定义了一些现成的,非常好用的应用层协议,供我们直接使用,HTTP(超文本传输协议)就是其中之一。        在互联网世界中,HTTP(超文本传输协议)是一个至关重要的协议,他定义了客户端(如浏览器)与服务器之间如何进行通信,以交换或者传输超文本(比如HTML文档)。

如何编写Linux PCIe设备驱动器 之二

如何编写Linux PCIe设备驱动器 之二 功能(capability)集功能(capability)APIs通过pci_bus_read_config完成功能存取功能APIs参数pos常量值PCI功能结构 PCI功能IDMSI功能电源功率管理功能 功能(capability)集 功能(capability)APIs int pcie_capability_read_wo