Spark Mllib里的Mllib基本数据类型(图文详解)
不多说,直接上干货!
Spark Mllib基本数据类型,根据不同的作用和应用场景,分为四种不同的类型
1、Local vector : 本地向量集,主要向spark提供一组可进行操作的数据集合
2、Labeled point: 向量标签,让用户能够分类不同的数据集合
3、Local matrix:本地矩阵,将数据集合以矩阵形式存储在本地计算机中。
4、Distributed matrix : 分布式矩阵,将数据集合以矩阵形式存储在分布式计算机中
具体,见
Spark Mllib机器学习实战的第4章 Mllib基本数据类型和Mllib数理统计
作者:大数据和人工智能躺过的坑
出处:http://www.cnblogs.com/zlslch/
本文版权归作者和博客园共有,欢迎转载,但未经作者同意必须保留此段声明,且在文章页面明显位置给出原文链接,否则保留追究法律责任的权利。
如果您认为这篇文章还不错或者有所收获,您可以通过右边的“打赏”功能 打赏我一杯咖啡【物质支持】,也可以点击右下角的【好文要顶】按钮【精神支持】,因为这两种支持都是我继续写作,分享的最大动力!

浙公网安备 33010602011771号