当前位置: 首页 > wzjs >正文

哪些公司网站做的好百度24小时人工客服

哪些公司网站做的好,百度24小时人工客服,logo注册网站,app软件开发摄像头RDD基本概念 Resilient Distributed Dataset 叫做弹性分布式数据集,是Spark中最基本的数据抽象,是分布式计算的实现载体,代表一个不可变,可分区,里面的元素并行计算的集合。 - Dataset: 一个数据集合&…
RDD基本概念

Resilient Distributed Dataset 叫做弹性分布式数据集,是Spark中最基本的数据抽象,是分布式计算的实现载体,代表一个不可变,可分区,里面的元素并行计算的集合。

- Dataset: 一个数据集合,用来存放数据的。之前我们学习的Scala中,Array, Set等也叫数据集。

- Distributed: 分布式存储的,表示数据是存放在不同的机器上的。这就和我们前面学习数据结构就不同了。

- Resilient: 数据可以保存在内存或者磁盘中。

然后,我们在看看它的定义中的一些关键字:

不可变的:immutable。类比理解scala中的不可变集合或者是使用val修饰的变量。

可分区的:集合的数据课划分成为很多部分,每部分称为分区:Partition

并行计算:集合中的数据可以被并行的计算处理,每个分区数据被一个Task任务处理。

RDD的创建

spark的计算功能是通过RDD来实现的,那么如何去创建RDD呢?有两种创建方式。

1.从集合内存中创建

可以通过将本地集合(如数组、列表等)传递给 SparkContext 的 parallelize 方法来创建 RDD。

// 创建 SparkConf 和 SparkContext

    val conf = new SparkConf().setAppName("RDDFromCollection").setMaster("local[*]")

    val sc = new SparkContext(conf)

    // 创建一个本地集合

    val data = Array(1, 2, 3, 4, 5)

    // 通过 parallelize 方法将本地集合转换为 RDD

    val distData = sc.parallelize(data, 2) // 第二个参数是分区数

2.从外部存储中创建。例如,读入外部的文件。

// 创建 SparkConf 和 SparkContext

    val conf = new SparkConf().setAppName("RDDFromHDFS").setMaster("local[*]")

    val sc = new SparkContext(conf)

    // 从 HDFS 加载文本文件

    val hdfsRDD = sc.textFile("hdfs://namenode:8020/path/to/your/file.txt")
// 获取并打印分区数val partitionCount = hdfsRDD.getNumPartitions

println(s"The number of partitions is: $partitionCount")

可以通过getNumPartitions来获取分区的数量。

SparkConf 和 SparkContext

SparkConf 类用于配置 Spark 应用程序的各种参数。通过 SparkConf 类,你可以设置应用程序的名称、运行模式(如本地模式、集群模式)、资源分配(如内存、CPU 核心数)等。

主要作用配置应用程序参数:可以设置 Spark 应用程序的各种属性,如应用程序名称、主节点地址等。

管理配置信息:将配置信息封装在一个对象中,方便在应用程序中传递和使用。

SparkContext 是 Spark 应用程序的入口点,它代表了与 Spark 集群的连接。通过 SparkContext,你可以创建 RDD(弹性分布式数据集)、累加器、广播变量等,还可以与外部数据源进行交互。

http://www.dtcms.com/wzjs/221700.html

相关文章:

  • 购物网站建设报价表体验营销案例
  • 重庆可作为推广的网站太原网站推广排名
  • 做旅游网站的目的发帖子最好的几个网站
  • 北京网站建设公司收购北京网站建设东轩seo
  • 如何自己做网站建设滨州网站建设
  • 阿里云做网站需要些什么上海搜索引擎优化公司
  • 佳作哪个公司做网站比较好手机百度正式版
  • 网站建设评判网站页面禁止访问
  • 九江 网站建设公司google手机官网
  • 网站建设从入门到精通创建网站需要多少资金
  • 湖南省交通建设质监局网站怎么创建一个属于自己的网站
  • 丽之鑫科技网站后台怎么做网站推广策划思路的内容
  • 宜昌住房和城乡建设厅网站推广软文发布平台
  • 网站备案指的是什么口碑营销的形式
  • qq是哪个工作室开发的短视频搜索seo
  • 阿里巴巴网站怎么设计师新网站友链
  • 上海好的高端网站建设服务公司脚本外链平台
  • 邵阳网站建设推广佛山做优化的网络公司
  • 免费外贸b2c网站建设技术培训机构排名前十
  • 给别人做网站赚钱吗竞价托管就选微竞价
  • 个人网站建设方案书例文seo培训学院
  • 最近日本mv字幕免费高清网络优化工程师工作内容
  • 做网站的软件adobe网络推广有哪些
  • 做网站域名备案需要多久seo营销的概念
  • 大学生创业项目seo外包上海
  • 网站用微信登录 要怎么做厦门关键词优化报价
  • 宝应网站建设seo门户 site
  • 盐城网站开发公司自媒体视频剪辑培训班
  • php做小公司网站用什么框架seo推广培训
  • 怎么做视频直播网站站长之家备案查询