多项选择题
A.弹性分布式数据集。B.逻辑上是分区的,每个分区的数据是抽象存在的。C.不能改变现有rdd中的数据。D.相邻的rdd之间存在着血缘关系。
A.SparkCoreB.SparkStreamingC.SparkMlibD.SparkGraphX
A.分为ReceiverAPI和DirectAPIB.使用ReceiverAPI可能会导致计算数据的节点内存溢出C.使用DirectAPI可以增加消费的并行度D.两种API都可以手动维护offset 保存位置