Statistic Data From file via Java

2023-11-11 13:38
文章标签 java file data via statistic

本文主要是介绍Statistic Data From file via Java,希望对大家解决编程问题提供一定的参考价值,需要的开发者们随着小编来一起学习吧!

由于一个朋友工作的需要,需要统计很多文件里的数据,由于手工统计的工作量比较大,于是求助于我通过程序来统计。
需求:将所有数据从小到大合并成一个文件,重复数据只保留一个!并分别统计出前四位相同数据的个数!


数据片段:

19610618,
19610619,
19610622,
19610623,
19610718,
19980814,
19980820,
19980822,
19980831,

20040804,
20040809,
20040810,
20050405,
20050429,
20050619,

 

数据分散在不同的文件里面

/**
 * @author Seave
 * @since 2006-06-25
 * @version 1.0
 * 文件数据统计
 * 将所有数据从小到大合并成一个文件,重复数据只保留一个!
 * 并分别统计出前四位相同数据的个数!
 */
import java.io.BufferedReader;
import java.io.File;
import java.io.FileInputStream;
import java.io.FileOutputStream;
import java.io.InputStreamReader;
import java.util.ArrayList;

import java.io.IOException;

public class DataStatistic
{
 //原始数据文件目录
 private final static String directoryPath = "d://chengqiao//";
 
 //统计后生成的文件
 private final static String geneteratePath = "d://statisticResult.txt";
 /**
  * @author Seave
  * @since 2006-06-25
  * read file
  * @return
  */
 private static ArrayList readFile()
 {
  ArrayList al = new ArrayList();
  File file = new File(directoryPath);
  String fileList[] = file.list();
  
  for(int i = 0;i < fileList.length; i++)
  {
   //得到文件名,放在list数组里
   al.add(fileList[i]);
  }
  return al;
 }
 
 /**
  * @author Seave
  * @since 2005-06-25
  * combin file,同时去掉重复数据
  *
  */
 private static ArrayList combinData()
 {
  ArrayList alLine = new ArrayList();
  try
  {
   ArrayList al = readFile();
   for(int i = 0;i < al.size();i++)
   {
    String fileName = (String)al.get(i);
    FileInputStream fin = new FileInputStream(directoryPath+fileName);
    BufferedReader bRead = new BufferedReader(new InputStreamReader(fin));
          String line = "";
    while ((line = bRead.readLine())!= null)
          {
     if(alLine.contains(line))
     {
      //已经存入,则不add进去了
      continue;
     }
     alLine.add(line);
          }
    fin.close();
    bRead.close();
   }
  }
  catch(IOException ioe)
  {
   ioe.printStackTrace();
  }
  return alLine;
 }
 
 
 /**
  * @author Seave
  * @since 2005-06-25
  * 排序,从小到大排序
  *
  */
 private static ArrayList sortData()
 {
  //存放排序后的数据
  ArrayList alSort = new ArrayList();
  //需要排序的数据
  ArrayList al = combinData();
  //clone ArrayList Data
  ArrayList alClone = (ArrayList)al.clone();
  
  while(al.size() > 0)
  {
   String minData = (String)al.get(0);
   int tempIndex = 0;  
   if(alSort.contains(minData))
   {
    //如果此数据已经排序,则删除此数据,同时重新开始特循环
    al.remove(minData);
    continue;
   }
   for(int j = 0;j < alClone.size();j++)
   { 
    String tempData = (String)alClone.get(j);
    if(minData.compareTo(tempData) > 0)
    {
     //当前数据同克隆数组里的数据相比较
     minData = tempData;
     tempIndex = j;
    }
   }
   
//   System.out.println("minData result = " + minData);
//   System.out.println("================================"); 
   alSort.add(minData);
   //当得到最小的数据时,把此次循环得到的最小数据移出克隆数组
   alClone.remove(tempIndex);   
  }
  return alSort;
 }
 
 /**
  * @author Seave
  * @since 2005-06-25
  * 分别统计出前四位相同数据的个数
  *
  */
 private static ArrayList statisticData()
 {
  ArrayList fourAl = new ArrayList();
  ArrayList fourAndCountAl = new ArrayList();
  ArrayList al = sortData();
  for(int i = 0;i < al.size();i++)
  {
   String alStr = (String)al.get(i);
   //获取前四位
   String fourStartStr = alStr.substring(0,4);
   if(fourAl.contains(fourStartStr))
    continue;
   fourAl.add(fourStartStr);
  }
  for(int i = 0;i < fourAl.size();i++)
  {
   String year = (String)fourAl.get(i);
   int count = 0;
   for(int j = 0;j < al.size();j++)
   {
    String alStr = (String)al.get(j);
    String fourStartStr = alStr.substring(0,4);
    if(fourStartStr.equals(year))
    {
     //计算相同的年份的数量
     count++;
    }
   }
   
   fourAndCountAl.add(year+":" + count+"条数据");
  }
  return fourAndCountAl;
 }
 
 /**
  * @author Seave
  * @since 2005-06-25
  * 写文件
  *
  */
 private static void writeFile(ArrayList al)
 {
  try
  {
   File f = new File(geneteratePath);
   if(!f.exists())
    f.createNewFile();
   
   FileOutputStream fout = new FileOutputStream(geneteratePath);
   
   for(int i = 0; i < al.size();i++)
   {
    byte b[] = new byte[al.size()];
    b = new String((String)al.get(i)+"/n").getBytes();
    //写入文件
    fout.write(b);
   }
   fout.flush();
   //close FileOutputStream
   fout.close();
  }
  catch(IOException ioe)
  {
   ioe.printStackTrace();
  }
 }
 
 
 public static void main(String[] args)
 {
  ArrayList alSort = sortData();
  ArrayList alStatic = statisticData();
  for(int i = 0;i < alSort.size();i++)
  {
   //组织要同一个list里
   alStatic.add(alSort.get(i));
  }
  writeFile(alStatic);
 }
}

 

最后的统计结果片段:

1961:66条数据
1962:61条数据
1963:62条数据
1964:64条数据

1998:52条数据
1999:34条数据
2000:42条数据
2001:42条数据
2002:40条数据
2003:44条数据
2004:45条数据
2005:48条数据

19610618,
19610619,
19610622,
19610623,

20040827,
20041215,
20050310,
20050311,

 

 

这篇关于Statistic Data From file via Java的文章就介绍到这儿,希望我们推荐的文章对编程师们有所帮助!



http://www.chinasem.cn/article/390426

相关文章

Java编译生成多个.class文件的原理和作用

《Java编译生成多个.class文件的原理和作用》作为一名经验丰富的开发者,在Java项目中执行编译后,可能会发现一个.java源文件有时会产生多个.class文件,从技术实现层面详细剖析这一现象... 目录一、内部类机制与.class文件生成成员内部类(常规内部类)局部内部类(方法内部类)匿名内部类二、

SpringBoot实现数据库读写分离的3种方法小结

《SpringBoot实现数据库读写分离的3种方法小结》为了提高系统的读写性能和可用性,读写分离是一种经典的数据库架构模式,在SpringBoot应用中,有多种方式可以实现数据库读写分离,本文将介绍三... 目录一、数据库读写分离概述二、方案一:基于AbstractRoutingDataSource实现动态

Springboot @Autowired和@Resource的区别解析

《Springboot@Autowired和@Resource的区别解析》@Resource是JDK提供的注解,只是Spring在实现上提供了这个注解的功能支持,本文给大家介绍Springboot@... 目录【一】定义【1】@Autowired【2】@Resource【二】区别【1】包含的属性不同【2】@

springboot循环依赖问题案例代码及解决办法

《springboot循环依赖问题案例代码及解决办法》在SpringBoot中,如果两个或多个Bean之间存在循环依赖(即BeanA依赖BeanB,而BeanB又依赖BeanA),会导致Spring的... 目录1. 什么是循环依赖?2. 循环依赖的场景案例3. 解决循环依赖的常见方法方法 1:使用 @La

Java枚举类实现Key-Value映射的多种实现方式

《Java枚举类实现Key-Value映射的多种实现方式》在Java开发中,枚举(Enum)是一种特殊的类,本文将详细介绍Java枚举类实现key-value映射的多种方式,有需要的小伙伴可以根据需要... 目录前言一、基础实现方式1.1 为枚举添加属性和构造方法二、http://www.cppcns.co

Elasticsearch 在 Java 中的使用教程

《Elasticsearch在Java中的使用教程》Elasticsearch是一个分布式搜索和分析引擎,基于ApacheLucene构建,能够实现实时数据的存储、搜索、和分析,它广泛应用于全文... 目录1. Elasticsearch 简介2. 环境准备2.1 安装 Elasticsearch2.2 J

Java中的String.valueOf()和toString()方法区别小结

《Java中的String.valueOf()和toString()方法区别小结》字符串操作是开发者日常编程任务中不可或缺的一部分,转换为字符串是一种常见需求,其中最常见的就是String.value... 目录String.valueOf()方法方法定义方法实现使用示例使用场景toString()方法方法

Java中List的contains()方法的使用小结

《Java中List的contains()方法的使用小结》List的contains()方法用于检查列表中是否包含指定的元素,借助equals()方法进行判断,下面就来介绍Java中List的c... 目录详细展开1. 方法签名2. 工作原理3. 使用示例4. 注意事项总结结论:List 的 contain

Java实现文件图片的预览和下载功能

《Java实现文件图片的预览和下载功能》这篇文章主要为大家详细介绍了如何使用Java实现文件图片的预览和下载功能,文中的示例代码讲解详细,感兴趣的小伙伴可以跟随小编一起学习一下... Java实现文件(图片)的预览和下载 @ApiOperation("访问文件") @GetMapping("

Spring Boot + MyBatis Plus 高效开发实战从入门到进阶优化(推荐)

《SpringBoot+MyBatisPlus高效开发实战从入门到进阶优化(推荐)》本文将详细介绍SpringBoot+MyBatisPlus的完整开发流程,并深入剖析分页查询、批量操作、动... 目录Spring Boot + MyBATis Plus 高效开发实战:从入门到进阶优化1. MyBatis