编程语言
首页 > 编程语言> > 2.安装Spark与Python练习

2.安装Spark与Python练习

作者:互联网

一、安装Spark

环境配置:

 

启动spark:

 

 试运行python代码:

 

 

二、Python编程练习:英文文本的词频统计

  1. 准备文本文件
  2. 读文件
  3. 预处理:大小写,标点符号,停用词
  4. 分词
  5. 统计每个单词出现的次数
  6. 按词频大小排序
  7. 结果写文件

 思路:先读取文件文本内容,使用循环将内容中的每一个标点符号替换为空,再将内容所有字母替换为小写字母并分词,最后利用循环统计词频,并用列表储存进行排序,将结果显示。

文本截图:

 

 代码截图:

 

 

 运行结果截图:

 

标签:截图,Python,练习,词频,Spark,文本,分词
来源: https://www.cnblogs.com/WX0014/p/15972697.html