
数据结构和低频词过滤。
5星
- 浏览量: 0
- 大小:None
- 文件类型:None
简介:
该系统设计了一种低频词过滤方案,针对一篇特定的英文文本,它分别采用线性表和二叉排序树两种数据结构来统计单词的出现频率。具体而言,该系统首先读取英文文章文件(InFile.txt),并对其进行单词识别。随后,它利用线性表和二叉排序树两种不同的存储结构来构建包含所有单词的存储体系。每次识别出新的单词时,如果该单词尚未存在于线性表或二叉排序树中,则将其添加到相应的存储位置;如果该单词已经存在,则更新其在存储结构中的出现次数。在完成统计后,系统会根据预设的频率阈值(低于五次)删除低频词,并展示这些被删除的词语及其对应的出现频率。最后,剩余的单词及其出现的频率将按照从高到低的顺序写入到输出文件中(OutFile.txt)。此外,系统还会记录并输出使用两种不同方法完成此任务所花费的时间。
全部评论 (0)
还没有任何评论哟~


