您的位置:首页 > 汽车 > 新车 > 新开传奇网页游戏_房产网加盟_英文seo是什么_深圳百度公司地址在哪里

新开传奇网页游戏_房产网加盟_英文seo是什么_深圳百度公司地址在哪里

2024/10/7 0:12:31 来源:https://blog.csdn.net/pblh123/article/details/142577595  浏览:    关键词:新开传奇网页游戏_房产网加盟_英文seo是什么_深圳百度公司地址在哪里
新开传奇网页游戏_房产网加盟_英文seo是什么_深圳百度公司地址在哪里

需求:

1、做某个文件的词频统计//某个单词在这个文件出现次数

步骤:

  1. 文件单词规律(空格分开)
  2. 单词切分
  3. 单词的统计(k,v)->(k:单词,V:数量)
  4. 打印

框架:

  1. 单例对象,main()
  2. 创建CONF
  3. 创建SC-->读取文件的方式--》RDD
  4. RDD进行处理
  5. 闭资源关

一、新建object类取名为WordCount

2、编写如下代码

import org.apache.spark.{SparkConf, SparkContext}object WordCount {def main(args: Array[String]): Unit = {System.setProperty("hadoop.home.dir","D:\\hadoop\\hadoop-2.8.0")val sparkConf= new SparkConf().setAppName("WordCount").setMaster("local") //设置为本地模式val sc = new SparkContext(sparkConf)sc.setLogLevel("WARN")val resultArray = sc.textFile(path = "file:///d:/temp/a.txt").flatMap(_.split(" ")).map((_,1)).reduceByKey(_+_).collect()resultArray.foreach(println )sc.stop()}}

3、本地运行,查看运行结果如下:

解决无法下载spark与打包插件的办法

maven打包插件与spark所需依赖下载地址:

链接:百度网盘 请输入提取码

提取码:jnta

解决步骤:

到网盘下载maven打包插件与spark依赖,网盘吗中的内容如下:

  1. 将下载的插件plugins.rar解压,并复制插件文件夹到你本地maven仓库下
  2. 将下载的spark依赖spark.rar解压,并复制spark文件夹到你本地maven仓库下
  3. 重启idea,重新build下工程

将下载的插件plugins.rar解压,并复制插件文件夹到你本地maven仓库下

将下载的spark依赖spark.rar解压,并复制spark文件夹到你本地maven仓库下

重启idea,重新build下工程

版权声明:

本网仅为发布的内容提供存储空间,不对发表、转载的内容提供任何形式的保证。凡本网注明“来源:XXX网络”的作品,均转载自其它媒体,著作权归作者所有,商业转载请联系作者获得授权,非商业转载请注明出处。

我们尊重并感谢每一位作者,均已注明文章来源和作者。如因作品内容、版权或其它问题,请及时与我们联系,联系邮箱:809451989@qq.com,投稿邮箱:809451989@qq.com