大数据之LibrA数据库系统告警处理(ALM-12017 磁盘容量不足)

本文主要是介绍大数据之LibrA数据库系统告警处理(ALM-12017 磁盘容量不足),希望对大家解决编程问题提供一定的参考价值,需要的开发者们随着小编来一起学习吧!

告警解释

系统每30秒周期性检测磁盘使用率,并把磁盘使用率和阈值相比较。磁盘使用率有一个默认阈值,当检测到磁盘使用率超过阈值时产生该告警。

平滑次数为1,主机磁盘某一分区使用率小于或等于阈值时,告警恢复;平滑次数大于1,主机磁盘某一分区使用率小于或等于阈值的90%时,告警恢复。

告警属性

告警ID

告警级别

可自动清除

12017

严重

告警参数

参数名称

参数含义

ServiceName

产生告警的服务名称。

RoleName

产生告警的角色名称。

HostName

产生告警的主机名。

PartitionName

产生告警的磁盘分区。

Trigger Condition

系统当前指标取值满足自定义的告警设置条件。

对系统的影响

业务进程不可用。

可能原因
  • 告警阈值配置不合理。
  • 磁盘配置无法满足业务需求,磁盘使用率达到上限。
处理步骤

检查阈值设置是否合理。

  1. 登录FusionInsight Manager,查看该告警阈值是否不合理(默认90%为合理值,用户可以根据自己的实际需求调节)。

    • 是,执行步骤 2。
    • 否,执行步骤 4。

  2. 根据实际服务的使用情况在“系统设置 > 阈值配置 > 设备 > 主机 > 磁盘 > 磁盘使用率 > 磁盘使用率”中更改告警阈值。

    图1所示

    图1 设置告警阈值

  3. 等待2分钟,查看告警是否消失。

    • 是,处理完毕。
    • 否,执行步骤 4。

检查磁盘使用率是否达到上限

  1. 打开FusionInsight Manager页面,在告警列表中,单击此告警所在行,在告警详情中,查看该告警的主机名称和磁盘分区信息。
  2. 使用PuTTY工具,以root用户登录告警所在节点。
  3. 执行df -h命令,查看系统磁盘分区的使用信息。并通过步骤 4中获取到的磁盘分区名称,查看该磁盘是否挂载在如下几个目录下:“/”、“/boot”、“/home”、“/opt”、“/tmp”、“/var”、“/var/log”、“/boot”、“/srv/BigData”(可自定义)。

    • 是,说明该磁盘为系统盘,执行步骤 10。
    • 否,说明该磁盘为非系统盘,执行步骤 7。

  4. 执行df -h命令,查看系统磁盘分区的使用信息。并通过步骤 4中获取到的磁盘分区名称,判断该磁盘属于哪一个角色。
  5. 磁盘所属服务:

    • FusionInsight HD,是否为HDFS、Yarn、Solr、Kafka、Supervisor或者Redis其中之一。
      • 是,参考《FusionInsight HD 容量调整指导书》进行容量调整。执行步骤 3
      • 否,执行步骤 12。
    • FusionInsight LibrA,是否为MPPDB。
      • 是,参考《FusionInsight LibrA 容量调整指导书》进行容量调整。执行步骤 3。
      • 否,执行步骤 12。

  6. 等待2分钟,查看告警是否消失。

    • 是,处理完毕。
    • 否,执行步骤 12。

  7. 执行命令find / -xdev -size +500M -exec ls -l {} \;,查看该节点上超过500MB的文件,查看该磁盘中,是否有误写入的大文件存在。

    • 是,执行步骤 11。
    • 否,执行步骤 12。

  8. 处理该误写入的文件,并等待2分钟,查看告警是否清除。

    • 是,执行完毕。
    • 否,执行步骤 12。

  9. 联系系统管理员,对磁盘进行扩容。
  10. 等待2分钟,查看告警是否消失。

    • 是,处理完毕。
    • 否,执行步骤 14。

收集故障信息。

  1. 在FusionInsight Manager界面,单击“系统设置 > 日志下载”。
  2. 在“服务”下拉框中勾选“Manager”,单击“确定”。
  3. 设置日志收集的“开始时间”和“结束时间”分别为告警产生时间的前后10分钟,单击“下载”。

这篇关于大数据之LibrA数据库系统告警处理(ALM-12017 磁盘容量不足)的文章就介绍到这儿,希望我们推荐的文章对编程师们有所帮助!



http://www.chinasem.cn/article/348879

相关文章

Python获取中国节假日数据记录入JSON文件

《Python获取中国节假日数据记录入JSON文件》项目系统内置的日历应用为了提升用户体验,特别设置了在调休日期显示“休”的UI图标功能,那么问题是这些调休数据从哪里来呢?我尝试一种更为智能的方法:P... 目录节假日数据获取存入jsON文件节假日数据读取封装完整代码项目系统内置的日历应用为了提升用户体验,

Python FastAPI+Celery+RabbitMQ实现分布式图片水印处理系统

《PythonFastAPI+Celery+RabbitMQ实现分布式图片水印处理系统》这篇文章主要为大家详细介绍了PythonFastAPI如何结合Celery以及RabbitMQ实现简单的分布式... 实现思路FastAPI 服务器Celery 任务队列RabbitMQ 作为消息代理定时任务处理完整

C#使用SQLite进行大数据量高效处理的代码示例

《C#使用SQLite进行大数据量高效处理的代码示例》在软件开发中,高效处理大数据量是一个常见且具有挑战性的任务,SQLite因其零配置、嵌入式、跨平台的特性,成为许多开发者的首选数据库,本文将深入探... 目录前言准备工作数据实体核心技术批量插入:从乌龟到猎豹的蜕变分页查询:加载百万数据异步处理:拒绝界面

Springboot处理跨域的实现方式(附Demo)

《Springboot处理跨域的实现方式(附Demo)》:本文主要介绍Springboot处理跨域的实现方式(附Demo),具有很好的参考价值,希望对大家有所帮助,如有错误或未考虑完全的地方,望不... 目录Springboot处理跨域的方式1. 基本知识2. @CrossOrigin3. 全局跨域设置4.

Java利用JSONPath操作JSON数据的技术指南

《Java利用JSONPath操作JSON数据的技术指南》JSONPath是一种强大的工具,用于查询和操作JSON数据,类似于SQL的语法,它为处理复杂的JSON数据结构提供了简单且高效... 目录1、简述2、什么是 jsONPath?3、Java 示例3.1 基本查询3.2 过滤查询3.3 递归搜索3.4

MySQL大表数据的分区与分库分表的实现

《MySQL大表数据的分区与分库分表的实现》数据库的分区和分库分表是两种常用的技术方案,本文主要介绍了MySQL大表数据的分区与分库分表的实现,文中通过示例代码介绍的非常详细,对大家的学习或者工作具有... 目录1. mysql大表数据的分区1.1 什么是分区?1.2 分区的类型1.3 分区的优点1.4 分

Mysql删除几亿条数据表中的部分数据的方法实现

《Mysql删除几亿条数据表中的部分数据的方法实现》在MySQL中删除一个大表中的数据时,需要特别注意操作的性能和对系统的影响,本文主要介绍了Mysql删除几亿条数据表中的部分数据的方法实现,具有一定... 目录1、需求2、方案1. 使用 DELETE 语句分批删除2. 使用 INPLACE ALTER T

python+opencv处理颜色之将目标颜色转换实例代码

《python+opencv处理颜色之将目标颜色转换实例代码》OpenCV是一个的跨平台计算机视觉库,可以运行在Linux、Windows和MacOS操作系统上,:本文主要介绍python+ope... 目录下面是代码+ 效果 + 解释转HSV: 关于颜色总是要转HSV的掩膜再标注总结 目标:将红色的部分滤

Python Dash框架在数据可视化仪表板中的应用与实践记录

《PythonDash框架在数据可视化仪表板中的应用与实践记录》Python的PlotlyDash库提供了一种简便且强大的方式来构建和展示互动式数据仪表板,本篇文章将深入探讨如何使用Dash设计一... 目录python Dash框架在数据可视化仪表板中的应用与实践1. 什么是Plotly Dash?1.1

Python实现自动化接收与处理手机验证码

《Python实现自动化接收与处理手机验证码》在移动互联网时代,短信验证码已成为身份验证、账号注册等环节的重要安全手段,本文将介绍如何利用Python实现验证码的自动接收,识别与转发,需要的可以参考下... 目录引言一、准备工作1.1 硬件与软件需求1.2 环境配置二、核心功能实现2.1 短信监听与获取2.