ATS线上报告个别日志过大无法写入问题的解决方法

2024-03-18 15:38

本文主要是介绍ATS线上报告个别日志过大无法写入问题的解决方法,希望对大家解决编程问题提供一定的参考价值,需要的开发者们随着小编来一起学习吧!

访问日志是分析CDN线上问题的重要参考依据,但是我们在实际运维中发现很多部署点日志记录出现一些小问题,会造成相应的日志条目丢失。我们发现线上一些服务器上时常会报告如下问题:

diags.log中经常报如下错误:

[Mar 31 02:39:34.185] Server {0x2b1d85563700} NOTE: <LogObject.cc:616 (log)> Skipping the current log entry for access.log because its size (9136) exceeds the maximum payload space in a log buffer
分析问题
这里已经指出了报错日志的代码位置在LogObject.cc:616,导致出错的函数位置的源码是

显然我们需要研究 _checkout_write()函数的实现,并关注返回为NULL的值,里面实际上是调用
result_code = buffer->checkout_write(write_offset, bytes_needed);
来控制多线程同步写日志,

上述日志信息所走的流程是

它是result_code的返回码LogBuffer::LB_BUFFER_TOO_SMALL,所以最终我们还得查看 LogBuffer::checkout_write()返回该状态码的地方,注意如下函数的返回值
LB_ResultCode ret_val = LB_BUSY;
返回的该代码是

上面的比较,m_size的值很关键,我们需要关注m_size的默认赋值是多少?这是写日志的一个初始缓存的长度,字符串型的,在 LogBuffer.cc

它是调用它的构造函数生成的
LogBuffer(LogObject * owner, size_t size,   size_t buf_align = LB_DEFAULT_ALIGN, size_t write_align = INK_MIN_ALIGN);

可以看出分配指定长度的缓存给m_unaligned_buffer,并将它对齐为m_buffer,动态释放内存的地方在析构函数中

建议gdb追踪来找到调用点,发现还是在LogObject.cc中有几处地方,都有如下代码
LogBuffer *b = NEW (new LogBuffer (this,  Log::config->log_buffer_size));
现在继续追踪Log的配置项,在sourceInsight中搜索 log_buffer_size得到

结果很清楚了,配置项配大点就可以了。
解决方法
在records.config中添加一项proxy.config.log.log_buffer_size,配置大些就可以了。直接热修改如下:
traffic_line -r proxy.config.log.log_buffer_size
traffic_line -s proxy.config.log.log_buffer_size -v 40960
traffic_line -x
如果还是报类似上面的错误,可以继续酌情修改这个值,总之,要根据业务的实际情况修改


更进一步修正

修改上述配置后,发现线上日志出现如下报错


经过查看,发现与另一个配置proxy.config.log.max_line_size有关,它的默认值也是9216

解决方法

在records.config中添加一条配置(可根据实际情况酌情修改)

CONFIG proxy.config.log.max_line_size INT 15000

下面是修改前后的判决图


下面是源码追踪流程,不愿深究的可以略去。

调用流程追踪

报错地方的源码是


在source insight中追踪源码中的max_line_size可以看到基本调用流程。


剩下的是配置项的读取



总结:最终一个通用的设置,在records.config中加入:

CONFIG proxy.config.log.max_line_size INT 35000
CONFIG proxy.config.log.log_buffer_size INT 262144

这篇关于ATS线上报告个别日志过大无法写入问题的解决方法的文章就介绍到这儿,希望我们推荐的文章对编程师们有所帮助!



http://www.chinasem.cn/article/822814

相关文章

Kotlin Map映射转换问题小结

《KotlinMap映射转换问题小结》文章介绍了Kotlin集合转换的多种方法,包括map(一对一转换)、mapIndexed(带索引)、mapNotNull(过滤null)、mapKeys/map... 目录Kotlin 集合转换:map、mapIndexed、mapNotNull、mapKeys、map

Nginx安全防护的多种方法

《Nginx安全防护的多种方法》在生产环境中,需要隐藏Nginx的版本号,以避免泄漏Nginx的版本,使攻击者不能针对特定版本进行攻击,下面就来介绍一下Nginx安全防护的方法,感兴趣的可以了解一下... 目录核心安全配置1.编译安装 Nginx2.隐藏版本号3.限制危险请求方法4.请求限制(CC攻击防御)

nginx中端口无权限的问题解决

《nginx中端口无权限的问题解决》当Nginx日志报错bind()to80failed(13:Permissiondenied)时,这通常是由于权限不足导致Nginx无法绑定到80端口,下面就来... 目录一、问题原因分析二、解决方案1. 以 root 权限运行 Nginx(不推荐)2. 为 Nginx

python生成随机唯一id的几种实现方法

《python生成随机唯一id的几种实现方法》在Python中生成随机唯一ID有多种方法,根据不同的需求场景可以选择最适合的方案,文中通过示例代码介绍的非常详细,需要的朋友们下面随着小编来一起学习学习... 目录方法 1:使用 UUID 模块(推荐)方法 2:使用 Secrets 模块(安全敏感场景)方法

解决1093 - You can‘t specify target table报错问题及原因分析

《解决1093-Youcan‘tspecifytargettable报错问题及原因分析》MySQL1093错误因UPDATE/DELETE语句的FROM子句直接引用目标表或嵌套子查询导致,... 目录报js错原因分析具体原因解决办法方法一:使用临时表方法二:使用JOIN方法三:使用EXISTS示例总结报错原

Windows环境下解决Matplotlib中文字体显示问题的详细教程

《Windows环境下解决Matplotlib中文字体显示问题的详细教程》本文详细介绍了在Windows下解决Matplotlib中文显示问题的方法,包括安装字体、更新缓存、配置文件设置及编码調整,并... 目录引言问题分析解决方案详解1. 检查系统已安装字体2. 手动添加中文字体(以SimHei为例)步骤

MyBatis-Plus通用中等、大量数据分批查询和处理方法

《MyBatis-Plus通用中等、大量数据分批查询和处理方法》文章介绍MyBatis-Plus分页查询处理,通过函数式接口与Lambda表达式实现通用逻辑,方法抽象但功能强大,建议扩展分批处理及流式... 目录函数式接口获取分页数据接口数据处理接口通用逻辑工具类使用方法简单查询自定义查询方法总结函数式接口

MySQL深分页进行性能优化的常见方法

《MySQL深分页进行性能优化的常见方法》在Web应用中,分页查询是数据库操作中的常见需求,然而,在面对大型数据集时,深分页(deeppagination)却成为了性能优化的一个挑战,在本文中,我们将... 目录引言:深分页,真的只是“翻页慢”那么简单吗?一、背景介绍二、深分页的性能问题三、业务场景分析四、

JAVA中安装多个JDK的方法

《JAVA中安装多个JDK的方法》文章介绍了在Windows系统上安装多个JDK版本的方法,包括下载、安装路径修改、环境变量配置(JAVA_HOME和Path),并说明如何通过调整JAVA_HOME在... 首先去oracle官网下载好两个版本不同的jdk(需要登录Oracle账号,没有可以免费注册)下载完

SpringSecurity整合redission序列化问题小结(最新整理)

《SpringSecurity整合redission序列化问题小结(最新整理)》文章详解SpringSecurity整合Redisson时的序列化问题,指出需排除官方Jackson依赖,通过自定义反序... 目录1. 前言2. Redission配置2.1 RedissonProperties2.2 Red