1109 综合实验:文件操作与字符处理 SCAU

2024-04-22 01:08

本文主要是介绍1109 综合实验:文件操作与字符处理 SCAU,希望对大家解决编程问题提供一定的参考价值,需要的开发者们随着小编来一起学习吧!

1109 综合实验:文件操作与字符处理 SCAU

题目描述

Description

在当前目录中存在文件名为"case1.in"(其中case后为数字1,不是字母l,写错提交后会判错)的文本文件,
其内容为一篇英文文章(以EOF作为结束标志)。现要求读取该文本文件内容,统计文章中每个单词出现的次数,
并输出出现次数最多的前5个单词及其出现次数(按出现次数由多到少的顺序输出,次数相同时按字典顺序输出,
不足5个单词时,按序输出全部单词)。程序中注意如下细节:
(1) 空格、标点符号与回车符起到分隔单词的作用。
(2) 文章一行的末尾可能有连字符,出现连字符时,该行最末的字符串与下行最先出现的字符串构一个单词;
(3) 名词缩写算一个单词;
(4) 数字不算单词;
(5) 单词不区分大小写;
(6) 输出时单词全使用小写;

#include “stdio.h”
#include “math.h”
#include “string.h”
#include “stdlib.h”


main()
{
_______________________
}

输入格式
文件case1.in中一篇英文文章,包含多段文字,单词数不超过10000,每个单词不超过20个字符

输出格式
按题意输出答案

输入样例
(如case1.in内容如下)
I am a student. My school is SCAU. It is a beau-
tiful university. I like it.

输出样例
a 2
i 2
is 2
it 2
am 1

思路

用fgetc从文件中读取字符并进行处理,然后用选择排序的方法进行排序,最后输出。
使用结构体数组储存数据。

题目分析

从文件中读取文本内容,然后统计单词个数并按字典顺序和单词出现次数对单词进行排序,最后输出次数最多的前5个单词及其出现次数(按出现次数由多到少的顺序输出,次数相同时按字典顺序输出,不足5个单词时,按序输出全部单词),从而实现一个简单的统计排序功能。

变量说明

结构体d_word 储存单词和单词出现次数,使用结构体数组d_word T[10005]储存去重排序处理后单词信息,字符数组char words[10005] [25]储存从文件中读取的初始单词信息。

算法描述

使用选择排序的方法对单词次数从大到小排序,同时对单词出现次数相同的单词进行字典排序。选择排序的时间复杂度是O(n*n)。

单词去重和统计次数使用遍历数组的暴力算法,把初始读入的words数组中的元素一一与结构体数组T中元素比较,如果数组T中不存在该单词,则复制words数组中单词进T中,单词出现次数加1;若已经存在该单词,找到该单词所在数组位置,该单词出现次数加1。时间复杂度也是n的平方。

总结

一开始读取文件使用了fscanf读入一个字符串,然后发现读入之后较难进行单词处理,所以改用了每次读取一个字符的方法,对字符进行处理判断,并以读入单词,标点符号,回车符作为一个单词结束的标志。这样可以比较方便地处理分割单词,并且对一些不属于单词的字符可以不用读入数组中,比如空格或换行符,只是在写判断单词结束条件时花了比较多的时间。然后是排序那里一开始使用的是快排,后来发现快排写字典排序反而超时了,就使用了较简单的选择排序,复杂度是n的平方。运行时间是736 ms。

代码


#include "stdio.h"
#include "math.h"
#include "string.h"
#include "stdlib.h"typedef struct d_word
{char word[25] = {'\0'};int time = 0;
} d_word;int getfile(char words[][25],d_word T[])//从文件中读取单词并返回单词个数
{FILE* fp;fp = fopen("case1.in", "r");if (fp==NULL){printf ("error");exit(0);}char temp[25],ch,ch1;int i, j, q=0, k,n=0,num=0;while((ch=fgetc(fp))!=EOF){if(ch>='a'&&ch<='z')words[n][q++]=ch;else if(ch>='A'&&ch<='Z')words[n][q++]=ch+32;else if(ch=='-')//判断是否为连字符{ch=fgetc(fp);if(ch=='\n')continue;else{n++;q=0;if(ch>='a'&&ch<='z')words[n][q++]=ch;else if(ch>='A'&&ch<='Z')words[n][q++]=ch+32;}}else{n++;q=0;}}for(i=0; i<n; i++){if(words[i][0]<'a'||words[i][0]>'z'){words[i][0]='\0';}}fclose(fp);return n;
}int De_duplication(int n,d_word T[],char words[][25])//单词去重+统计出现次数
{int num = 0;int i, j, k;int flag = 0;for (i = 0; i < n; i++){for (j = 1,flag=0; j <= num&&words[i][0]!='\0'; j++){if (strcmp(words[i], T[j].word)==0){flag = 1;T[j].time++;break;}}if (flag != 1&&words[i][0]!='\0'){num++;strcpy(T[j].word, words[i]);T[j].time++;}flag=0;}return num;
}void Sort(d_word T[],int m)//选择排序
{int i,j,k;char temp[25];for (i = 1; i < m ; i++){k = i;for (j = i + 1; j <= m; j++)if (T[k].time < T[j].time || (T[k].time == T[j].time && strcmp(T[k].word, T[j].word) > 0))k = j;if (k != i){int t = T[k].time;T[k].time = T[i].time;T[i].time = t;memset(temp,0,sizeof(temp));strcpy(temp, T[k].word);memset(T[k].word,0,sizeof(T[k].word));strcpy(T[k].word, T[i].word);memset(T[i].word,0,sizeof(T[i].word));strcpy(T[i].word, temp);}}return;
}int main()
{char words[10005][25];int i, j, k, n, m;d_word T[10005];n=getfile(words,T);//读取文件m=De_duplication(n,T,words);//去重+计数Sort(T, m);//选择排序for (i=1; i<=5&&i<=m; i++){printf("%s %d\n",T[i].word,T[i].time);}return 0;
}
参考(https://blog.csdn.net/Hunter_Kevin/article/details/117005682)

这篇关于1109 综合实验:文件操作与字符处理 SCAU的文章就介绍到这儿,希望我们推荐的文章对编程师们有所帮助!



http://www.chinasem.cn/article/924486

相关文章

C#使用SQLite进行大数据量高效处理的代码示例

《C#使用SQLite进行大数据量高效处理的代码示例》在软件开发中,高效处理大数据量是一个常见且具有挑战性的任务,SQLite因其零配置、嵌入式、跨平台的特性,成为许多开发者的首选数据库,本文将深入探... 目录前言准备工作数据实体核心技术批量插入:从乌龟到猎豹的蜕变分页查询:加载百万数据异步处理:拒绝界面

Mysql表的简单操作(基本技能)

《Mysql表的简单操作(基本技能)》在数据库中,表的操作主要包括表的创建、查看、修改、删除等,了解如何操作这些表是数据库管理和开发的基本技能,本文给大家介绍Mysql表的简单操作,感兴趣的朋友一起看... 目录3.1 创建表 3.2 查看表结构3.3 修改表3.4 实践案例:修改表在数据库中,表的操作主要

C# WinForms存储过程操作数据库的实例讲解

《C#WinForms存储过程操作数据库的实例讲解》:本文主要介绍C#WinForms存储过程操作数据库的实例,具有很好的参考价值,希望对大家有所帮助,如有错误或未考虑完全的地方,望不吝赐教... 目录一、存储过程基础二、C# 调用流程1. 数据库连接配置2. 执行存储过程(增删改)3. 查询数据三、事务处

Java使用Curator进行ZooKeeper操作的详细教程

《Java使用Curator进行ZooKeeper操作的详细教程》ApacheCurator是一个基于ZooKeeper的Java客户端库,它极大地简化了使用ZooKeeper的开发工作,在分布式系统... 目录1、简述2、核心功能2.1 CuratorFramework2.2 Recipes3、示例实践3

Springboot处理跨域的实现方式(附Demo)

《Springboot处理跨域的实现方式(附Demo)》:本文主要介绍Springboot处理跨域的实现方式(附Demo),具有很好的参考价值,希望对大家有所帮助,如有错误或未考虑完全的地方,望不... 目录Springboot处理跨域的方式1. 基本知识2. @CrossOrigin3. 全局跨域设置4.

Java利用JSONPath操作JSON数据的技术指南

《Java利用JSONPath操作JSON数据的技术指南》JSONPath是一种强大的工具,用于查询和操作JSON数据,类似于SQL的语法,它为处理复杂的JSON数据结构提供了简单且高效... 目录1、简述2、什么是 jsONPath?3、Java 示例3.1 基本查询3.2 过滤查询3.3 递归搜索3.4

python+opencv处理颜色之将目标颜色转换实例代码

《python+opencv处理颜色之将目标颜色转换实例代码》OpenCV是一个的跨平台计算机视觉库,可以运行在Linux、Windows和MacOS操作系统上,:本文主要介绍python+ope... 目录下面是代码+ 效果 + 解释转HSV: 关于颜色总是要转HSV的掩膜再标注总结 目标:将红色的部分滤

Python实现自动化接收与处理手机验证码

《Python实现自动化接收与处理手机验证码》在移动互联网时代,短信验证码已成为身份验证、账号注册等环节的重要安全手段,本文将介绍如何利用Python实现验证码的自动接收,识别与转发,需要的可以参考下... 目录引言一、准备工作1.1 硬件与软件需求1.2 环境配置二、核心功能实现2.1 短信监听与获取2.

Python使用date模块进行日期处理的终极指南

《Python使用date模块进行日期处理的终极指南》在处理与时间相关的数据时,Python的date模块是开发者最趁手的工具之一,本文将用通俗的语言,结合真实案例,带您掌握date模块的六大核心功能... 目录引言一、date模块的核心功能1.1 日期表示1.2 日期计算1.3 日期比较二、六大常用方法详

Python使用DrissionPage中ChromiumPage进行自动化网页操作

《Python使用DrissionPage中ChromiumPage进行自动化网页操作》DrissionPage作为一款轻量级且功能强大的浏览器自动化库,为开发者提供了丰富的功能支持,本文将使用Dri... 目录前言一、ChromiumPage基础操作1.初始化Drission 和 ChromiumPage