Statistic Data From file via Java

2023-11-11 13:38
文章标签 java file data via statistic

本文主要是介绍Statistic Data From file via Java,希望对大家解决编程问题提供一定的参考价值,需要的开发者们随着小编来一起学习吧!

由于一个朋友工作的需要,需要统计很多文件里的数据,由于手工统计的工作量比较大,于是求助于我通过程序来统计。
需求:将所有数据从小到大合并成一个文件,重复数据只保留一个!并分别统计出前四位相同数据的个数!


数据片段:

19610618,
19610619,
19610622,
19610623,
19610718,
19980814,
19980820,
19980822,
19980831,

20040804,
20040809,
20040810,
20050405,
20050429,
20050619,

 

数据分散在不同的文件里面

/**
 * @author Seave
 * @since 2006-06-25
 * @version 1.0
 * 文件数据统计
 * 将所有数据从小到大合并成一个文件,重复数据只保留一个!
 * 并分别统计出前四位相同数据的个数!
 */
import java.io.BufferedReader;
import java.io.File;
import java.io.FileInputStream;
import java.io.FileOutputStream;
import java.io.InputStreamReader;
import java.util.ArrayList;

import java.io.IOException;

public class DataStatistic
{
 //原始数据文件目录
 private final static String directoryPath = "d://chengqiao//";
 
 //统计后生成的文件
 private final static String geneteratePath = "d://statisticResult.txt";
 /**
  * @author Seave
  * @since 2006-06-25
  * read file
  * @return
  */
 private static ArrayList readFile()
 {
  ArrayList al = new ArrayList();
  File file = new File(directoryPath);
  String fileList[] = file.list();
  
  for(int i = 0;i < fileList.length; i++)
  {
   //得到文件名,放在list数组里
   al.add(fileList[i]);
  }
  return al;
 }
 
 /**
  * @author Seave
  * @since 2005-06-25
  * combin file,同时去掉重复数据
  *
  */
 private static ArrayList combinData()
 {
  ArrayList alLine = new ArrayList();
  try
  {
   ArrayList al = readFile();
   for(int i = 0;i < al.size();i++)
   {
    String fileName = (String)al.get(i);
    FileInputStream fin = new FileInputStream(directoryPath+fileName);
    BufferedReader bRead = new BufferedReader(new InputStreamReader(fin));
          String line = "";
    while ((line = bRead.readLine())!= null)
          {
     if(alLine.contains(line))
     {
      //已经存入,则不add进去了
      continue;
     }
     alLine.add(line);
          }
    fin.close();
    bRead.close();
   }
  }
  catch(IOException ioe)
  {
   ioe.printStackTrace();
  }
  return alLine;
 }
 
 
 /**
  * @author Seave
  * @since 2005-06-25
  * 排序,从小到大排序
  *
  */
 private static ArrayList sortData()
 {
  //存放排序后的数据
  ArrayList alSort = new ArrayList();
  //需要排序的数据
  ArrayList al = combinData();
  //clone ArrayList Data
  ArrayList alClone = (ArrayList)al.clone();
  
  while(al.size() > 0)
  {
   String minData = (String)al.get(0);
   int tempIndex = 0;  
   if(alSort.contains(minData))
   {
    //如果此数据已经排序,则删除此数据,同时重新开始特循环
    al.remove(minData);
    continue;
   }
   for(int j = 0;j < alClone.size();j++)
   { 
    String tempData = (String)alClone.get(j);
    if(minData.compareTo(tempData) > 0)
    {
     //当前数据同克隆数组里的数据相比较
     minData = tempData;
     tempIndex = j;
    }
   }
   
//   System.out.println("minData result = " + minData);
//   System.out.println("================================"); 
   alSort.add(minData);
   //当得到最小的数据时,把此次循环得到的最小数据移出克隆数组
   alClone.remove(tempIndex);   
  }
  return alSort;
 }
 
 /**
  * @author Seave
  * @since 2005-06-25
  * 分别统计出前四位相同数据的个数
  *
  */
 private static ArrayList statisticData()
 {
  ArrayList fourAl = new ArrayList();
  ArrayList fourAndCountAl = new ArrayList();
  ArrayList al = sortData();
  for(int i = 0;i < al.size();i++)
  {
   String alStr = (String)al.get(i);
   //获取前四位
   String fourStartStr = alStr.substring(0,4);
   if(fourAl.contains(fourStartStr))
    continue;
   fourAl.add(fourStartStr);
  }
  for(int i = 0;i < fourAl.size();i++)
  {
   String year = (String)fourAl.get(i);
   int count = 0;
   for(int j = 0;j < al.size();j++)
   {
    String alStr = (String)al.get(j);
    String fourStartStr = alStr.substring(0,4);
    if(fourStartStr.equals(year))
    {
     //计算相同的年份的数量
     count++;
    }
   }
   
   fourAndCountAl.add(year+":" + count+"条数据");
  }
  return fourAndCountAl;
 }
 
 /**
  * @author Seave
  * @since 2005-06-25
  * 写文件
  *
  */
 private static void writeFile(ArrayList al)
 {
  try
  {
   File f = new File(geneteratePath);
   if(!f.exists())
    f.createNewFile();
   
   FileOutputStream fout = new FileOutputStream(geneteratePath);
   
   for(int i = 0; i < al.size();i++)
   {
    byte b[] = new byte[al.size()];
    b = new String((String)al.get(i)+"/n").getBytes();
    //写入文件
    fout.write(b);
   }
   fout.flush();
   //close FileOutputStream
   fout.close();
  }
  catch(IOException ioe)
  {
   ioe.printStackTrace();
  }
 }
 
 
 public static void main(String[] args)
 {
  ArrayList alSort = sortData();
  ArrayList alStatic = statisticData();
  for(int i = 0;i < alSort.size();i++)
  {
   //组织要同一个list里
   alStatic.add(alSort.get(i));
  }
  writeFile(alStatic);
 }
}

 

最后的统计结果片段:

1961:66条数据
1962:61条数据
1963:62条数据
1964:64条数据

1998:52条数据
1999:34条数据
2000:42条数据
2001:42条数据
2002:40条数据
2003:44条数据
2004:45条数据
2005:48条数据

19610618,
19610619,
19610622,
19610623,

20040827,
20041215,
20050310,
20050311,

 

 

这篇关于Statistic Data From file via Java的文章就介绍到这儿,希望我们推荐的文章对编程师们有所帮助!



http://www.chinasem.cn/article/390426

相关文章

Spring Boot @RestControllerAdvice全局异常处理最佳实践

《SpringBoot@RestControllerAdvice全局异常处理最佳实践》本文详解SpringBoot中通过@RestControllerAdvice实现全局异常处理,强调代码复用、统... 目录前言一、为什么要使用全局异常处理?二、核心注解解析1. @RestControllerAdvice2

Spring IoC 容器的使用详解(最新整理)

《SpringIoC容器的使用详解(最新整理)》文章介绍了Spring框架中的应用分层思想与IoC容器原理,通过分层解耦业务逻辑、数据访问等模块,IoC容器利用@Component注解管理Bean... 目录1. 应用分层2. IoC 的介绍3. IoC 容器的使用3.1. bean 的存储3.2. 方法注

Spring事务传播机制最佳实践

《Spring事务传播机制最佳实践》Spring的事务传播机制为我们提供了优雅的解决方案,本文将带您深入理解这一机制,掌握不同场景下的最佳实践,感兴趣的朋友一起看看吧... 目录1. 什么是事务传播行为2. Spring支持的七种事务传播行为2.1 REQUIRED(默认)2.2 SUPPORTS2

怎样通过分析GC日志来定位Java进程的内存问题

《怎样通过分析GC日志来定位Java进程的内存问题》:本文主要介绍怎样通过分析GC日志来定位Java进程的内存问题,具有很好的参考价值,希望对大家有所帮助,如有错误或未考虑完全的地方,望不吝赐教... 目录一、GC 日志基础配置1. 启用详细 GC 日志2. 不同收集器的日志格式二、关键指标与分析维度1.

Java进程异常故障定位及排查过程

《Java进程异常故障定位及排查过程》:本文主要介绍Java进程异常故障定位及排查过程,具有很好的参考价值,希望对大家有所帮助,如有错误或未考虑完全的地方,望不吝赐教... 目录一、故障发现与初步判断1. 监控系统告警2. 日志初步分析二、核心排查工具与步骤1. 进程状态检查2. CPU 飙升问题3. 内存

java中新生代和老生代的关系说明

《java中新生代和老生代的关系说明》:本文主要介绍java中新生代和老生代的关系说明,具有很好的参考价值,希望对大家有所帮助,如有错误或未考虑完全的地方,望不吝赐教... 目录一、内存区域划分新生代老年代二、对象生命周期与晋升流程三、新生代与老年代的协作机制1. 跨代引用处理2. 动态年龄判定3. 空间分

Java设计模式---迭代器模式(Iterator)解读

《Java设计模式---迭代器模式(Iterator)解读》:本文主要介绍Java设计模式---迭代器模式(Iterator),具有很好的参考价值,希望对大家有所帮助,如有错误或未考虑完全的地方,... 目录1、迭代器(Iterator)1.1、结构1.2、常用方法1.3、本质1、解耦集合与遍历逻辑2、统一

Java内存分配与JVM参数详解(推荐)

《Java内存分配与JVM参数详解(推荐)》本文详解JVM内存结构与参数调整,涵盖堆分代、元空间、GC选择及优化策略,帮助开发者提升性能、避免内存泄漏,本文给大家介绍Java内存分配与JVM参数详解,... 目录引言JVM内存结构JVM参数概述堆内存分配年轻代与老年代调整堆内存大小调整年轻代与老年代比例元空

深度解析Java DTO(最新推荐)

《深度解析JavaDTO(最新推荐)》DTO(DataTransferObject)是一种用于在不同层(如Controller层、Service层)之间传输数据的对象设计模式,其核心目的是封装数据,... 目录一、什么是DTO?DTO的核心特点:二、为什么需要DTO?(对比Entity)三、实际应用场景解析

Java 线程安全与 volatile与单例模式问题及解决方案

《Java线程安全与volatile与单例模式问题及解决方案》文章主要讲解线程安全问题的五个成因(调度随机、变量修改、非原子操作、内存可见性、指令重排序)及解决方案,强调使用volatile关键字... 目录什么是线程安全线程安全问题的产生与解决方案线程的调度是随机的多个线程对同一个变量进行修改线程的修改操