新开传奇网页游戏_房产网加盟_英文seo是什么_深圳百度公司地址在哪里

2025/2/28 20:24:59 来源：https://blog.csdn.net/pblh123/article/details/142577595 浏览: 次关键词：新开传奇网页游戏_房产网加盟_英文seo是什么_深圳百度公司地址在哪里

需求：

1、做某个文件的词频统计//某个单词在这个文件出现次数

步骤：

文件单词规律（空格分开）
单词切分
单词的统计（k,v）->(k:单词，V：数量）
打印

框架：

单例对象，main()
创建CONF
创建SC-->读取文件的方式--》RDD
RDD进行处理
闭资源关

一、新建object类取名为WordCount

2、编写如下代码

import org.apache.spark.{SparkConf, SparkContext}object WordCount {def main(args: Array[String]): Unit = {System.setProperty("hadoop.home.dir","D:\\hadoop\\hadoop-2.8.0")val sparkConf= new SparkConf().setAppName("WordCount").setMaster("local") //设置为本地模式val sc = new SparkContext(sparkConf)sc.setLogLevel("WARN")val resultArray = sc.textFile(path = "file:///d:/temp/a.txt").flatMap(_.split(" ")).map((_,1)).reduceByKey(_+_).collect()resultArray.foreach(println )sc.stop()}}

3、本地运行，查看运行结果如下：

解决无法下载spark与打包插件的办法

maven打包插件与spark所需依赖下载地址：

链接：百度网盘请输入提取码

提取码：jnta

解决步骤：

到网盘下载maven打包插件与spark依赖，网盘吗中的内容如下：

将下载的插件plugins.rar解压，并复制插件文件夹到你本地maven仓库下
将下载的spark依赖spark.rar解压，并复制spark文件夹到你本地maven仓库下
重启idea，重新build下工程

将下载的插件plugins.rar解压，并复制插件文件夹到你本地maven仓库下

将下载的spark依赖spark.rar解压，并复制spark文件夹到你本地maven仓库下

重启idea，重新build下工程

新开传奇网页游戏_房产网加盟_英文seo是什么_深圳百度公司地址在哪里

最新新闻

热搜词