大数据之LibrA数据库系统告警处理（ALM-12017 磁盘容量不足）

2023-11-05 09:20

文章标签 数据处理容量磁盘不足数据库系统告警 libra alm 12017

本文主要是介绍大数据之LibrA数据库系统告警处理（ALM-12017 磁盘容量不足），希望对大家解决编程问题提供一定的参考价值，需要的开发者们随着小编来一起学习吧！

告警解释

系统每30秒周期性检测磁盘使用率，并把磁盘使用率和阈值相比较。磁盘使用率有一个默认阈值，当检测到磁盘使用率超过阈值时产生该告警。

平滑次数为1，主机磁盘某一分区使用率小于或等于阈值时，告警恢复；平滑次数大于1，主机磁盘某一分区使用率小于或等于阈值的90%时，告警恢复。

告警属性

告警ID	告警级别	可自动清除
12017	严重	是

告警参数

参数名称	参数含义
ServiceName	产生告警的服务名称。
RoleName	产生告警的角色名称。
HostName	产生告警的主机名。
PartitionName	产生告警的磁盘分区。
Trigger Condition	系统当前指标取值满足自定义的告警设置条件。

对系统的影响

业务进程不可用。

可能原因

告警阈值配置不合理。
磁盘配置无法满足业务需求，磁盘使用率达到上限。

处理步骤

检查阈值设置是否合理。

登录FusionInsight Manager，查看该告警阈值是否不合理（默认90%为合理值，用户可以根据自己的实际需求调节）。
- 是，执行步骤 2。
- 否，执行步骤 4。
根据实际服务的使用情况在“系统设置 > 阈值配置 > 设备 > 主机 > 磁盘 > 磁盘使用率 > 磁盘使用率”中更改告警阈值。

如图1所示

 图1 设置告警阈值
等待2分钟，查看告警是否消失。
- 是，处理完毕。
- 否，执行步骤 4。

检查磁盘使用率是否达到上限

打开FusionInsight Manager页面，在告警列表中，单击此告警所在行，在告警详情中，查看该告警的主机名称和磁盘分区信息。
使用PuTTY工具，以root用户登录告警所在节点。
执行df -h命令，查看系统磁盘分区的使用信息。并通过
步骤 4中获取到的磁盘分区名称，查看该磁盘是否挂载在如下几个目录下：“/”、“/boot”、“/home”、“/opt”、“/tmp”、“/var”、“/var/log”、“/boot”、“/srv/BigData”（可自定义）。
- 是，说明该磁盘为系统盘，执行步骤 10。
- 否，说明该磁盘为非系统盘，执行步骤 7。
执行df -h命令，查看系统磁盘分区的使用信息。并通过步骤 4中获取到的磁盘分区名称，判断该磁盘属于哪一个角色。
磁盘所属服务：
- FusionInsight HD，是否为HDFS、Yarn、Solr、Kafka、Supervisor或者Redis其中之一。
  - 是，参考《FusionInsight HD 容量调整指导书》进行容量调整。执行步骤 3
  - 否，执行步骤 12。
- FusionInsight LibrA，是否为MPPDB。
  - 是，参考《FusionInsight LibrA 容量调整指导书》进行容量调整。执行步骤 3。
  - 否，执行步骤 12。
等待2分钟，查看告警是否消失。
- 是，处理完毕。
- 否，执行步骤 12。
执行命令find / -xdev -size +500M -exec ls -l {} \;，查看该节点上超过500MB的文件，查看该磁盘中，是否有误写入的大文件存在。
- 是，执行步骤 11。
- 否，执行步骤 12。
处理该误写入的文件，并等待2分钟，查看告警是否清除。
- 是，执行完毕。
- 否，执行步骤 12。
联系系统管理员，对磁盘进行扩容。
等待2分钟，查看告警是否消失。
- 是，处理完毕。
- 否，执行步骤 14。

收集故障信息。

在FusionInsight Manager界面，单击“系统设置 > 日志下载”。
在“服务”下拉框中勾选“Manager”，单击“确定”。
设置日志收集的“开始时间”和“结束时间”分别为告警产生时间的前后10分钟，单击“下载”。

这篇关于大数据之LibrA数据库系统告警处理（ALM-12017 磁盘容量不足）的文章就介绍到这儿，希望我们推荐的文章对编程师们有所帮助！

http://www.chinasem.cn/article/348879。 23002807@qq.com

相关文章

Pandas统计每行数据中的空值的方法示例

Pandas统计每行数据中的空值的方法示例

《Pandas统计每行数据中的空值的方法示例》处理缺失数据（NaN值）是一个非常常见的问题,本文主要介绍了Pandas统计每行数据中的空值的方法示例,具有一定的参考价值,感兴趣的可以了解一下... 目录什么是空值？为什么要统计空值？准备工作创建示例数据统计每行空值数量进一步分析www.chinasem.cn处

阅读更多...

如何使用 Python 读取 Excel 数据

如何使用 Python 读取 Excel 数据

《如何使用Python读取Excel数据》：本文主要介绍使用Python读取Excel数据的详细教程,通过pandas和openpyxl,你可以轻松读取Excel文件,并进行各种数据处理操... 目录使用 python 读取 Excel 数据的详细教程1. 安装必要的依赖2. 读取 Excel 文件3. 读

阅读更多...

Python Transformers库(NLP处理库)案例代码讲解

Python Transformers库(NLP处理库)案例代码讲解

《PythonTransformers库(NLP处理库)案例代码讲解》本文介绍transformers库的全面讲解,包含基础知识、高级用法、案例代码及学习路径,内容经过组织,适合不同阶段的学习者,对... 目录一、基础知识1. Transformers 库简介2. 安装与环境配置3. 快速上手示例二、核心模

阅读更多...

一文详解Java异常处理你都了解哪些知识

一文详解Java异常处理你都了解哪些知识

《一文详解Java异常处理你都了解哪些知识》：本文主要介绍Java异常处理的相关资料,包括异常的分类、捕获和处理异常的语法、常见的异常类型以及自定义异常的实现,文中通过代码介绍的非常详细,需要的朋... 目录前言一、什么是异常二、异常的分类2.1 受检异常2.2 非受检异常三、异常处理的语法3.1 try-

阅读更多...

Spring 请求之传递 JSON 数据的操作方法

Spring 请求之传递 JSON 数据的操作方法

《Spring请求之传递JSON数据的操作方法》JSON就是一种数据格式,有自己的格式和语法,使用文本表示一个对象或数组的信息,因此JSON本质是字符串,主要负责在不同的语言中数据传递和交换,这... 目录jsON 概念JSON 语法JSON 的语法JSON 的两种结构JSON 字符串和 Java 对象互转

阅读更多...

Python使用getopt处理命令行参数示例解析(最佳实践)

Python使用getopt处理命令行参数示例解析(最佳实践)

《Python使用getopt处理命令行参数示例解析(最佳实践)》getopt模块是Python标准库中一个简单但强大的命令行参数处理工具,它特别适合那些需要快速实现基本命令行参数解析的场景,或者需要... 目录为什么需要处理命令行参数？getopt模块基础实际应用示例与其他参数处理方式的比较常见问http

阅读更多...

SQL中redo log 刷⼊磁盘的常见方法

SQL中redo log 刷⼊磁盘的常见方法

《SQL中redolog刷⼊磁盘的常见方法》本文主要介绍了SQL中redolog刷⼊磁盘的常见方法,将redolog刷入磁盘的方法确保了数据的持久性和一致性,下面就来具体介绍一下,感兴趣的可以了解... 目录Redo Log 刷入磁盘的方法Redo Log 刷入磁盘的过程代码示例（伪代码）在数据库系统中，r

阅读更多...

Java Response返回值的最佳处理方案

Java Response返回值的最佳处理方案

《JavaResponse返回值的最佳处理方案》在开发Web应用程序时,我们经常需要通过HTTP请求从服务器获取响应数据,这些数据可以是JSON、XML、甚至是文件,本篇文章将详细解析Java中处理... 目录摘要概述核心问题：关键技术点：源码解析示例 1：使用HttpURLConnection获取Resp

阅读更多...

C++如何通过Qt反射机制实现数据类序列化

C++如何通过Qt反射机制实现数据类序列化

《C++如何通过Qt反射机制实现数据类序列化》在C++工程中经常需要使用数据类,并对数据类进行存储、打印、调试等操作,所以本文就来聊聊C++如何通过Qt反射机制实现数据类序列化吧... 目录设计预期设计思路代码实现使用方法在 C++ 工程中经常需要使用数据类，并对数据类进行存储、打印、调试等操作。由于数据类

阅读更多...

Java中Switch Case多个条件处理方法举例

Java中Switch Case多个条件处理方法举例

《Java中SwitchCase多个条件处理方法举例》Java中switch语句用于根据变量值执行不同代码块,适用于多个条件的处理,：本文主要介绍Java中SwitchCase多个条件处理的相... 目录前言基本语法处理多个条件示例1：合并相同代码的多个case示例2：通过字符串合并多个case进阶用法使用

阅读更多...