spark学习笔记3
摘要:
Spark 支持在集群范围内将数据集缓存至每一个节点的内存中,可避免数据传输,当数据需要重复访问时这个特征非常有用,例如查询体积小的“热”数据集,或是运行如 PageRank 的迭代算法。调用 cache(),就可以将数据集进行缓存: Spark SQL和 DataFrame可以用于处理结构化数据。 阅读全文
posted @ 2018-07-02 12:26
我和你并没有不同
阅读(214)
评论(0)
推荐(0)
浙公网安备 33010602011771号