python实现统计文本中单词出现的频率详解

合集下载

1、下载文档前请自行甄别文档内容的完整性，平台不提供额外的编辑、内容补充、找答案等附加服务。
2、"仅部分预览"的文档,不可在线预览部分如存在完整性等问题,可反馈申请退款(可完整预览的文档不适用该条件!)。
3、如文档侵犯您的权益，请联系客服反馈,我们会尽快为您处理(人工客服工作时间：9:00-18:30)。

python实现统计⽂本中单词出现的频率详解
本⽂实例为⼤家分享了python统计⽂本中单词出现频率的具体代码，供⼤家参考，具体内容如下
#coding=utf-8
import os
from collections import Counter
sumsdata=[]
for fname in os.listdir(os.getcwd()):
if os.path.isfile(fname) and fname.endswith('.txt'):
with open(fname,'r') as fp:
data=fp.readlines()
sumsdata+=[line.strip().lower() for line in data]
cnt=Counter()
for word in sumsdata:
cnt[word]+=1
cnt=dict(cnt)
for key,value in cnt.items():
print(key+":"+str(value))
⾸先在和程序所在路径下创建⼏个⽂本⽂件，我建了两个，⽂件内容分别为hello python goodbye python 和 i like python。

运⾏程序，得到以下结果
以上所述是⼩编给⼤家介绍的python统计⽂本中单词出现频率详解整合，希望对⼤家有所帮助，如果⼤家有任何疑问请给我留⾔，⼩编会及时回复⼤家的。

在此也⾮常感谢⼤家对⽹站的⽀持！。