大数据:随机生成10万个整数找出出现次数前一百的数

2024-03-23 06:08

本文主要是介绍大数据:随机生成10万个整数找出出现次数前一百的数,希望对大家解决编程问题提供一定的参考价值,需要的开发者们随着小编来一起学习吧!

实现大数据处理的基本方法是分治法+heapsort

/**
* @100 000个整形数据,范围在0~32768
* 1.输出最大
* 2.输出次数前100的数
*/#include <stdio.h>
#include <assert.h>
#include <stdlib.h>
#include <time.h>typedef struct
{int num[100];int times[100];
}Date;
typedef struct
{int num;int times;
}Time;void myheap(Time arr[],int len,int cur)
{int maxnode = cur*2+1;if(maxnode+1<len && arr[maxnode].times<arr[maxnode+1].times){maxnode++;}for(int fnode=cur; maxnode<len;){int temp;if(arr[maxnode].times > arr[fnode].times){temp = arr[maxnode].times;arr[maxnode].times = arr[fnode].times;arr[fnode].times = temp;temp = arr[maxnode].num;arr[maxnode].num = arr[fnode].num;arr[fnode].num = temp;}fnode = maxnode;maxnode = fnode*2+1;if(maxnode<len && maxnode<fnode*2+2 && arr[maxnode].times<arr[maxnode+1].times){maxnode++;}}
}
void show(Time arr[],int len)
{for(int i=0; i<len/100; i++){printf("%3d ",arr[i]);}printf("\n");
}
void heapsort(Time arr[],int len)
{for(int i = (len-1)/2; i>=0; i--){myheap(arr,len,i);}//show(arr,len);int temp;for(int i=len-1; i>0; i--){temp = arr[0].times;arr[0].times = arr[i].times;arr[i].times = temp;temp = arr[0].num;arr[0].num = arr[i].num;arr[i].num = temp;//show(arr,len);myheap(arr,i,0);//show(arr,len);}}
void Createdate(char* path)//创建数据
{FILE *fw = fopen(path,"wb");assert(fw != NULL);int temp;srand(time(NULL));//随机种子for(int i=0; i<1000000; i++){temp = rand();fwrite(&temp,sizeof(int),1,fw);}fclose(fw);
}
void  MyHasefile(char *path,Date *d)
{FILE *fr = fopen(path,"rb");assert(fr != NULL);int temp;int arr[10000] = {0};Time brr[10000] ;while(fread(&temp,sizeof(int),1,fr) > 0){arr[temp/10] += 1;}/*Date d ={0,0};d->times[0] = 0;d->num[0] = 0;*/for(int i=0; i<10000; i++){brr[i].times = arr[i];brr[i].num = i*10+temp%10;	}heapsort(brr,sizeof(brr)/sizeof(Time));for(int i=9999,j=0; i>=9900;i--,j++){d->num[j] = brr[i].num;d->times[j] = brr[i].times;}fclose(fr);return ;
}
void Divdate(char* path)//拆分数据
{char *mypath[10] = {"0.txt","1.txt","2.txt","3.txt","4.txt","5.txt","6.txt","7.txt","8.txt","9.txt"}; FILE *fr = fopen(path,"rb");assert(fr != NULL);FILE *fw[10];for(int i=0; i<10; i++){fw[i] = fopen(mypath[i],"wb");assert(fw[i] != NULL);}int temp;while(fread(&temp,sizeof(int),1,fr) > 0){fwrite(&temp,sizeof(int),1,fw[temp%10]);}for(int i=0; i<10; i++){fclose(fw[i]);}Date d[10] ;for(int i=0; i<10; i++){MyHasefile(mypath[i],&(d[i]));}Date dmax;for(int i=0; i<10; i++){for(int j=0; j<100; j++)if(d[i].times[j] >dmax.times[j]){dmax.times[j] = d[i].times[j];dmax.num[j] = d[i].num[j];}}for(int i=0; i<10; i++){remove(mypath[i]);}for(int i=0; i<100; i++)printf("num:%3d,times:%3d\n",dmax.num[i],dmax.times[i]);return ;
}int main()
{char *path = "D://date.txt";Createdate(path);//创建数据Divdate(path);//拆分数据}


这篇关于大数据:随机生成10万个整数找出出现次数前一百的数的文章就介绍到这儿,希望我们推荐的文章对编程师们有所帮助!



http://www.chinasem.cn/article/837373

相关文章

Python将大量遥感数据的值缩放指定倍数的方法(推荐)

《Python将大量遥感数据的值缩放指定倍数的方法(推荐)》本文介绍基于Python中的gdal模块,批量读取大量多波段遥感影像文件,分别对各波段数据加以数值处理,并将所得处理后数据保存为新的遥感影像... 本文介绍基于python中的gdal模块,批量读取大量多波段遥感影像文件,分别对各波段数据加以数值处

使用MongoDB进行数据存储的操作流程

《使用MongoDB进行数据存储的操作流程》在现代应用开发中,数据存储是一个至关重要的部分,随着数据量的增大和复杂性的增加,传统的关系型数据库有时难以应对高并发和大数据量的处理需求,MongoDB作为... 目录什么是MongoDB?MongoDB的优势使用MongoDB进行数据存储1. 安装MongoDB

MybatisGenerator文件生成不出对应文件的问题

《MybatisGenerator文件生成不出对应文件的问题》本文介绍了使用MybatisGenerator生成文件时遇到的问题及解决方法,主要步骤包括检查目标表是否存在、是否能连接到数据库、配置生成... 目录MyBATisGenerator 文件生成不出对应文件先在项目结构里引入“targetProje

Python MySQL如何通过Binlog获取变更记录恢复数据

《PythonMySQL如何通过Binlog获取变更记录恢复数据》本文介绍了如何使用Python和pymysqlreplication库通过MySQL的二进制日志(Binlog)获取数据库的变更记录... 目录python mysql通过Binlog获取变更记录恢复数据1.安装pymysqlreplicat

Linux使用dd命令来复制和转换数据的操作方法

《Linux使用dd命令来复制和转换数据的操作方法》Linux中的dd命令是一个功能强大的数据复制和转换实用程序,它以较低级别运行,通常用于创建可启动的USB驱动器、克隆磁盘和生成随机数据等任务,本文... 目录简介功能和能力语法常用选项示例用法基础用法创建可启动www.chinasem.cn的 USB 驱动

Python使用qrcode库实现生成二维码的操作指南

《Python使用qrcode库实现生成二维码的操作指南》二维码是一种广泛使用的二维条码,因其高效的数据存储能力和易于扫描的特点,广泛应用于支付、身份验证、营销推广等领域,Pythonqrcode库是... 目录一、安装 python qrcode 库二、基本使用方法1. 生成简单二维码2. 生成带 Log

Oracle数据库使用 listagg去重删除重复数据的方法汇总

《Oracle数据库使用listagg去重删除重复数据的方法汇总》文章介绍了在Oracle数据库中使用LISTAGG和XMLAGG函数进行字符串聚合并去重的方法,包括去重聚合、使用XML解析和CLO... 目录案例表第一种:使用wm_concat() + distinct去重聚合第二种:使用listagg,

Python实现将实体类列表数据导出到Excel文件

《Python实现将实体类列表数据导出到Excel文件》在数据处理和报告生成中,将实体类的列表数据导出到Excel文件是一项常见任务,Python提供了多种库来实现这一目标,下面就来跟随小编一起学习一... 目录一、环境准备二、定义实体类三、创建实体类列表四、将实体类列表转换为DataFrame五、导出Da

Python实现数据清洗的18种方法

《Python实现数据清洗的18种方法》本文主要介绍了Python实现数据清洗的18种方法,文中通过示例代码介绍的非常详细,对大家的学习或者工作具有一定的参考学习价值,需要的朋友们下面随着小编来一起学... 目录1. 去除字符串两边空格2. 转换数据类型3. 大小写转换4. 移除列表中的重复元素5. 快速统

Python中的随机森林算法与实战

《Python中的随机森林算法与实战》本文详细介绍了随机森林算法,包括其原理、实现步骤、分类和回归案例,并讨论了其优点和缺点,通过面向对象编程实现了一个简单的随机森林模型,并应用于鸢尾花分类和波士顿房... 目录1、随机森林算法概述2、随机森林的原理3、实现步骤4、分类案例:使用随机森林预测鸢尾花品种4.1