大数据:随机生成10万个整数找出出现次数前一百的数

2024-03-23 06:08

本文主要是介绍大数据:随机生成10万个整数找出出现次数前一百的数,希望对大家解决编程问题提供一定的参考价值,需要的开发者们随着小编来一起学习吧!

实现大数据处理的基本方法是分治法+heapsort

/**
* @100 000个整形数据,范围在0~32768
* 1.输出最大
* 2.输出次数前100的数
*/#include <stdio.h>
#include <assert.h>
#include <stdlib.h>
#include <time.h>typedef struct
{int num[100];int times[100];
}Date;
typedef struct
{int num;int times;
}Time;void myheap(Time arr[],int len,int cur)
{int maxnode = cur*2+1;if(maxnode+1<len && arr[maxnode].times<arr[maxnode+1].times){maxnode++;}for(int fnode=cur; maxnode<len;){int temp;if(arr[maxnode].times > arr[fnode].times){temp = arr[maxnode].times;arr[maxnode].times = arr[fnode].times;arr[fnode].times = temp;temp = arr[maxnode].num;arr[maxnode].num = arr[fnode].num;arr[fnode].num = temp;}fnode = maxnode;maxnode = fnode*2+1;if(maxnode<len && maxnode<fnode*2+2 && arr[maxnode].times<arr[maxnode+1].times){maxnode++;}}
}
void show(Time arr[],int len)
{for(int i=0; i<len/100; i++){printf("%3d ",arr[i]);}printf("\n");
}
void heapsort(Time arr[],int len)
{for(int i = (len-1)/2; i>=0; i--){myheap(arr,len,i);}//show(arr,len);int temp;for(int i=len-1; i>0; i--){temp = arr[0].times;arr[0].times = arr[i].times;arr[i].times = temp;temp = arr[0].num;arr[0].num = arr[i].num;arr[i].num = temp;//show(arr,len);myheap(arr,i,0);//show(arr,len);}}
void Createdate(char* path)//创建数据
{FILE *fw = fopen(path,"wb");assert(fw != NULL);int temp;srand(time(NULL));//随机种子for(int i=0; i<1000000; i++){temp = rand();fwrite(&temp,sizeof(int),1,fw);}fclose(fw);
}
void  MyHasefile(char *path,Date *d)
{FILE *fr = fopen(path,"rb");assert(fr != NULL);int temp;int arr[10000] = {0};Time brr[10000] ;while(fread(&temp,sizeof(int),1,fr) > 0){arr[temp/10] += 1;}/*Date d ={0,0};d->times[0] = 0;d->num[0] = 0;*/for(int i=0; i<10000; i++){brr[i].times = arr[i];brr[i].num = i*10+temp%10;	}heapsort(brr,sizeof(brr)/sizeof(Time));for(int i=9999,j=0; i>=9900;i--,j++){d->num[j] = brr[i].num;d->times[j] = brr[i].times;}fclose(fr);return ;
}
void Divdate(char* path)//拆分数据
{char *mypath[10] = {"0.txt","1.txt","2.txt","3.txt","4.txt","5.txt","6.txt","7.txt","8.txt","9.txt"}; FILE *fr = fopen(path,"rb");assert(fr != NULL);FILE *fw[10];for(int i=0; i<10; i++){fw[i] = fopen(mypath[i],"wb");assert(fw[i] != NULL);}int temp;while(fread(&temp,sizeof(int),1,fr) > 0){fwrite(&temp,sizeof(int),1,fw[temp%10]);}for(int i=0; i<10; i++){fclose(fw[i]);}Date d[10] ;for(int i=0; i<10; i++){MyHasefile(mypath[i],&(d[i]));}Date dmax;for(int i=0; i<10; i++){for(int j=0; j<100; j++)if(d[i].times[j] >dmax.times[j]){dmax.times[j] = d[i].times[j];dmax.num[j] = d[i].num[j];}}for(int i=0; i<10; i++){remove(mypath[i]);}for(int i=0; i<100; i++)printf("num:%3d,times:%3d\n",dmax.num[i],dmax.times[i]);return ;
}int main()
{char *path = "D://date.txt";Createdate(path);//创建数据Divdate(path);//拆分数据}


这篇关于大数据:随机生成10万个整数找出出现次数前一百的数的文章就介绍到这儿,希望我们推荐的文章对编程师们有所帮助!



http://www.chinasem.cn/article/837373

相关文章

Python使用Pandas对比两列数据取最大值的五种方法

《Python使用Pandas对比两列数据取最大值的五种方法》本文主要介绍使用Pandas对比两列数据取最大值的五种方法,包括使用max方法、apply方法结合lambda函数、函数、clip方法、w... 目录引言一、使用max方法二、使用apply方法结合lambda函数三、使用np.maximum函数

浅析如何使用Swagger生成带权限控制的API文档

《浅析如何使用Swagger生成带权限控制的API文档》当涉及到权限控制时,如何生成既安全又详细的API文档就成了一个关键问题,所以这篇文章小编就来和大家好好聊聊如何用Swagger来生成带有... 目录准备工作配置 Swagger权限控制给 API 加上权限注解查看文档注意事项在咱们的开发工作里,API

Redis的数据过期策略和数据淘汰策略

《Redis的数据过期策略和数据淘汰策略》本文主要介绍了Redis的数据过期策略和数据淘汰策略,文中通过示例代码介绍的非常详细,对大家的学习或者工作具有一定的参考学习价值,需要的朋友们下面随着小编来一... 目录一、数据过期策略1、惰性删除2、定期删除二、数据淘汰策略1、数据淘汰策略概念2、8种数据淘汰策略

轻松上手MYSQL之JSON函数实现高效数据查询与操作

《轻松上手MYSQL之JSON函数实现高效数据查询与操作》:本文主要介绍轻松上手MYSQL之JSON函数实现高效数据查询与操作的相关资料,MySQL提供了多个JSON函数,用于处理和查询JSON数... 目录一、jsON_EXTRACT 提取指定数据二、JSON_UNQUOTE 取消双引号三、JSON_KE

Python给Excel写入数据的四种方法小结

《Python给Excel写入数据的四种方法小结》本文主要介绍了Python给Excel写入数据的四种方法小结,包含openpyxl库、xlsxwriter库、pandas库和win32com库,具有... 目录1. 使用 openpyxl 库2. 使用 xlsxwriter 库3. 使用 pandas 库

SpringBoot定制JSON响应数据的实现

《SpringBoot定制JSON响应数据的实现》本文主要介绍了SpringBoot定制JSON响应数据的实现,文中通过示例代码介绍的非常详细,对大家的学习或者工作具有一定的参考学习价值,需要的朋友们... 目录前言一、如何使用@jsonView这个注解?二、应用场景三、实战案例注解方式编程方式总结 前言

使用Python在Excel中创建和取消数据分组

《使用Python在Excel中创建和取消数据分组》Excel中的分组是一种通过添加层级结构将相邻行或列组织在一起的功能,当分组完成后,用户可以通过折叠或展开数据组来简化数据视图,这篇博客将介绍如何使... 目录引言使用工具python在Excel中创建行和列分组Python在Excel中创建嵌套分组Pyt

Java使用POI-TL和JFreeChart动态生成Word报告

《Java使用POI-TL和JFreeChart动态生成Word报告》本文介绍了使用POI-TL和JFreeChart生成包含动态数据和图表的Word报告的方法,并分享了实际开发中的踩坑经验,通过代码... 目录前言一、需求背景二、方案分析三、 POI-TL + JFreeChart 实现3.1 Maven

在Rust中要用Struct和Enum组织数据的原因解析

《在Rust中要用Struct和Enum组织数据的原因解析》在Rust中,Struct和Enum是组织数据的核心工具,Struct用于将相关字段封装为单一实体,便于管理和扩展,Enum用于明确定义所有... 目录为什么在Rust中要用Struct和Enum组织数据?一、使用struct组织数据:将相关字段绑

在Mysql环境下对数据进行增删改查的操作方法

《在Mysql环境下对数据进行增删改查的操作方法》本文介绍了在MySQL环境下对数据进行增删改查的基本操作,包括插入数据、修改数据、删除数据、数据查询(基本查询、连接查询、聚合函数查询、子查询)等,并... 目录一、插入数据:二、修改数据:三、删除数据:1、delete from 表名;2、truncate