记一次多线程写入文件出现IOException:Stream Closed的问题

2024-03-12 18:28

本文主要是介绍记一次多线程写入文件出现IOException:Stream Closed的问题,希望对大家解决编程问题提供一定的参考价值,需要的开发者们随着小编来一起学习吧!

背景

        网关在解析1000个05文件(txt)写入到SFTP文件时,是每次读取1000 * 5条数据,然后每1000笔数据创建一个线程逐条数据进行字段数值映射转换,一共创建5个线程扔到线程池进行处理。每条数据解析完都会将数据写入到SFTP的DAT文件,并且累加条数写入到CTL文件。

原来是1000笔数据才进行解析,每个文件造数据10条,导入没问题。为了方便测试,把条数调小到每次读取5 * 2 条数据,每个文件有10条数据,方便验证多线程读取有无问题。

问题来了:预期是DAT文件会写入10笔数据,CTL文件记录的条数增加10,但是每次解析写到几条就抛异常了:IOException:Stream Closed,有时候能写2条,有时候能写4条,有时候能写8条.......

分析

  • 怀疑是不是因为改了网关的代码导致的,因为原来代码写死的1000,导入是没问题的,分析一波发现,原来每个文件只有10条数据,达不到1000,所以每次导入只会创建一个线程就处理完了,回检了一遍代码应该不是调小引发的问题;
  • 改成每次只读取5 * 2条,一次读取就把文件10条数据读完了,但是还是出现报错;改成每次只读取1 * 2条数据,要读取10 / 2 = 5次,才能读完,也还是会报错;
  • 是不是数据有问题呢?应该也不是,因为在配置1000的时候是能够把这10条数据正常写入的,打了断点也没发现write的时候写入的数据有啥问题 为什么会出现有时候能够写入2条就挂了,有时候写到4条呢.....发现是由于debug断点打的位置导致多个线程执行的快慢不一致导致的,如果不是debug的话正常postman触发是每次写了2条就报错了。补充一下:读取到数据并不是马上就写入到文件中,而是将数据加到一个dataList中存放,达到1000笔才写入;还有一个写入时机,那就是执行完每个线程会调用flush()方法,将dataList中的数据写入到txt
  • 原来每个线程处理完只返回boolean,主线程使用Future<Boolean>接收,看不到具体报错信息,在线程run()里面加了日志打印,也只能看到catch中的stream closed异常,看不到其他什么有效信息......
  • 试试其他思路:百度了一下Stream Closed这个报错原因,如果一个文件流对象已经关闭过了在finally再重复关闭一次的话会报这个错,由此猜测是不是因为我在write的时候文件流对象就被关闭了呢? debug断点打在写入前文件流对象那里,发现抛异常之前这个文件流对象一直都是正常的不为null,那为啥写入的时候会抛stream closed异常呢(有个误区:我一直以为closed了对象就会为null,后面才发现只是关闭只是跟句柄断开联系对象还不是null的)
  • 为啥其他文件的导入也是调用的ConvertIn这个通用的文件解析没有问题,我调用这个就有问题了呢。查看了一下其他文件的导入代码,发现其他文件的导入每次读取完1000条数据之后,并不是写入到文件,而是调用了作业条进行发送就返回了,不存在我这种写入文件的场景,自然就不会出现stream Closed的问题
  • 我这种场景跟导出的时候ConvertOut类似,读取文件数据之后再写入到txt中,对比了一个多线程里面的run()方法,发现我每次处理完一批数据就调用数据源的close()方法对文件流对象进行释放了,而导出的ConvertOut的话里面并没有closed文件对象,而是在处理完所有数据在finally才关闭文件流对象。每次创建线程的时候都将这个文件流对象传进去,导致有些线程在执行的时候将这个对象close了,其他线程在写的时候发现已经被关闭了,所以就报Stream Closed异常了
  • 至此,终于发现问题所在了,修改一下代码每个线程处理完不马上关闭这个文件流对象,而是在主线程外面的finally统一关闭一次,这样就不会出现多线程写入的时候报Stream Closed异常了

结论

  1. 调用别人的代码要认真阅读每行的逻辑,仔细斟酌有没有什么问题,是否适用,不能看都没看就放心使用,不然出了问题也不知道是什么原因.......
  2. 多线程进行文件写入时要注意及时关闭IO流对象防止内存泄漏

这篇关于记一次多线程写入文件出现IOException:Stream Closed的问题的文章就介绍到这儿,希望我们推荐的文章对编程师们有所帮助!



http://www.chinasem.cn/article/802178

相关文章

mybatis和mybatis-plus设置值为null不起作用问题及解决

《mybatis和mybatis-plus设置值为null不起作用问题及解决》Mybatis-Plus的FieldStrategy主要用于控制新增、更新和查询时对空值的处理策略,通过配置不同的策略类型... 目录MyBATis-plusFieldStrategy作用FieldStrategy类型每种策略的作

linux下多个硬盘划分到同一挂载点问题

《linux下多个硬盘划分到同一挂载点问题》在Linux系统中,将多个硬盘划分到同一挂载点需要通过逻辑卷管理(LVM)来实现,首先,需要将物理存储设备(如硬盘分区)创建为物理卷,然后,将这些物理卷组成... 目录linux下多个硬盘划分到同一挂载点需要明确的几个概念硬盘插上默认的是非lvm总结Linux下多

Python Jupyter Notebook导包报错问题及解决

《PythonJupyterNotebook导包报错问题及解决》在conda环境中安装包后,JupyterNotebook导入时出现ImportError,可能是由于包版本不对应或版本太高,解决方... 目录问题解决方法重新安装Jupyter NoteBook 更改Kernel总结问题在conda上安装了

pip install jupyterlab失败的原因问题及探索

《pipinstalljupyterlab失败的原因问题及探索》在学习Yolo模型时,尝试安装JupyterLab但遇到错误,错误提示缺少Rust和Cargo编译环境,因为pywinpty包需要它... 目录背景问题解决方案总结背景最近在学习Yolo模型,然后其中要下载jupyter(有点LSVmu像一个

解决jupyterLab打开后出现Config option `template_path`not recognized by `ExporterCollapsibleHeadings`问题

《解决jupyterLab打开后出现Configoption`template_path`notrecognizedby`ExporterCollapsibleHeadings`问题》在Ju... 目录jupyterLab打开后出现“templandroidate_path”相关问题这是 tensorflo

SpringBoot中使用 ThreadLocal 进行多线程上下文管理及注意事项小结

《SpringBoot中使用ThreadLocal进行多线程上下文管理及注意事项小结》本文详细介绍了ThreadLocal的原理、使用场景和示例代码,并在SpringBoot中使用ThreadLo... 目录前言技术积累1.什么是 ThreadLocal2. ThreadLocal 的原理2.1 线程隔离2

如何解决Pycharm编辑内容时有光标的问题

《如何解决Pycharm编辑内容时有光标的问题》文章介绍了如何在PyCharm中配置VimEmulator插件,包括检查插件是否已安装、下载插件以及安装IdeaVim插件的步骤... 目录Pycharm编辑内容时有光标1.如果Vim Emulator前面有对勾2.www.chinasem.cn如果tools工

最长公共子序列问题的深度分析与Java实现方式

《最长公共子序列问题的深度分析与Java实现方式》本文详细介绍了最长公共子序列(LCS)问题,包括其概念、暴力解法、动态规划解法,并提供了Java代码实现,暴力解法虽然简单,但在大数据处理中效率较低,... 目录最长公共子序列问题概述问题理解与示例分析暴力解法思路与示例代码动态规划解法DP 表的构建与意义动

Java多线程父线程向子线程传值问题及解决

《Java多线程父线程向子线程传值问题及解决》文章总结了5种解决父子之间数据传递困扰的解决方案,包括ThreadLocal+TaskDecorator、UserUtils、CustomTaskDeco... 目录1 背景2 ThreadLocal+TaskDecorator3 RequestContextH

关于Spring @Bean 相同加载顺序不同结果不同的问题记录

《关于Spring@Bean相同加载顺序不同结果不同的问题记录》本文主要探讨了在Spring5.1.3.RELEASE版本下,当有两个全注解类定义相同类型的Bean时,由于加载顺序不同,最终生成的... 目录问题说明测试输出1测试输出2@Bean注解的BeanDefiChina编程nition加入时机总结问题说明