- 链接地址:https://blog.csdn.net/hellozhxy/article/details/80523499
- 链接标题:Spark学习总结(一)_spark课程实训小结-CSDN博客
- 所属网站:blog.csdn.net
- 被收藏次数:4422
文章浏览阅读7.1w次,点赞33次,收藏225次。RDD及其特点1、RDD是Spark的核心数据模型,但是个抽象类,全称为Resillient Distributed Dataset,即弹性分布式数据集。2、RDD在抽象上来说是一种元素集合,包含了数据。它是被分区的,分为多个分区,每个分区分布在集群中的不同节点上,从而让RDD中的数据可以被并行操作。(分布式数据集)3、RDD通常通过Hadoop上的文件,即HDFS文件或者Hive表,来进行创建;..._spark课程实训小结
版权声明:本文发布于特牛网址导航 内容均来源于互联网 如有侵权联系删除
标签:spark课程实训小结