• linkedu视频
  • 平面设计
  • 电脑入门
  • 操作系统
  • 办公应用
  • 电脑硬件
  • 动画设计
  • 3D设计
  • 网页设计
  • CAD设计
  • 影音处理
  • 数据库
  • 程序设计
  • 认证考试
  • 信息管理
  • 信息安全
菜单
linkedu.com
导航菜单
  • 网页制作
  • 数据库
  • 程序设计
  • 操作系统
  • CMS教程
  • 游戏攻略
  • 脚本语言
  • 平面设计
  • 软件教程
  • 网络安全
  • 电脑知识
  • 服务器
  • 视频教程
  • windows
  • 服务器硬件
  • 服务器运维
  • 云计算
  • 虚拟化
  • IIS教程
  • Linux
  • Apache
  • Ftp
  • DNS
  • Nginx
您的位置:首页 > 服务器 >虚拟化 > 孙其功陪你学之——Spark MLlib之K-Means聚类算法,mllibk-means

孙其功陪你学之——Spark MLlib之K-Means聚类算法,mllibk-means

作者:网友 字体:[增加 减小] 来源:互联网

本文主要包含spark 聚类算法,孙其功,spark mllib,spark mllib是什么,spark mllib pdf等服务器相关知识,网友希望可以进行参考

孙其功陪你学之——Spark MLlib之K-Means聚类算法,mllibk-means


看到 程序员的自我修养 – SelfUp.cn 里面有Spark MLlib之K-Means聚类算法。

但是是java 语言的,于是我按照例程用Scala写了一个,分享在此。

由于在学习 spark mllib 但是如此详细的资料真的很难找,在此分享。

测试数据

0.0 0.0 0.0  0.1 0.1 0.1 0.2 0.2 0.2  9.0 9.0 9.0  9.1 9.1 9.1 9.2 9.2 9.2 15.1 15.1 15.1 18.0 17.0 19.0 20.0 21.0 22.0

package com.spark.firstApp

import org.apache.spark.SparkContext
import org.apache.spark.SparkConf
import org.apache.spark.mllib.clustering.KMeans
import org.apache.spark.mllib.linalg.Vectors
object HelloSpark {
  def main(args:Array[String]): Unit = {
    val conf = new SparkConf().setAppName("SimpleSVM Application")
    val sc = new SparkContext(conf)
    val data = sc.textFile("hdfs://192.168.0.10:9000/user/root/home/data1.txt")
    val parsedData = data.map(s => Vectors.dense(s.split(' ').map(_.toDouble))).cache()
    // Cluster the data into two classes using KMeans
    val numClusters = 2
    val numIterations = 20
    val clusters = KMeans.train(parsedData, numClusters, numIterations)
    // Evaluate clustering by computing Within Set Sum of Squared Errors
    val WSSSE = clusters.computeCost(parsedData)

    println("Within Set Sum of Squared Errors = " + WSSSE)

    val ss=parsedData.map(v => v.toString+ " belong to cluster :" + clusters.predict(v)).collect
    ss.foreach(a=>println(a.toString))

    println("Prediction of (1.1, 2.1, 3.1): " + clusters.predict(Vectors.dense(1.1, 2.1, 3.1)))
  }

}


root@Master:/# spark-submit --master spark://192.168.0.10:7077 --class com.spark.firstApp.HelloSpark --executor-memory 100m /root/IdeaProjects/FirstSparkApp/out/artifacts/FirstSparkAppjar/FirstSparkApp.jar


运行结果如下:

[0.0,0.0,0.0] belong to cluster :1
[0.1,0.1,0.1] belong to cluster :1
[0.2,0.2,0.2] belong to cluster :1
[9.0,9.0,9.0] belong to cluster :0
[9.1,9.1,9.1] belong to cluster :0
[9.2,9.2,9.2] belong to cluster :0
[15.1,16.1,17.0] belong to cluster :0
[18.0,17.0,19.0] belong to cluster :0
[20.0,21.0,22.0] belong to cluster :0
Prediction of (1.1, 2.1, 3.1): 1

分享到:QQ空间新浪微博腾讯微博微信百度贴吧QQ好友复制网址打印

您可能想查找下面的文章:

  • 孙其功陪你学之——Spark MLlib之K-Means聚类算法,mllibk-means

相关文章

  • 用Docker安装Gitlab的方法步骤
  • 详解VMware中CentOS配置多网卡多IP
  • CentOS7.2服务器上搭建Docker私有镜像仓库操作示例
  • 在docker上安装运行mysql实例
  • 详解ASP.NET Core Docker部署
  • openstack共享80、443端口的实例代码
  • 深入理解Xen虚拟机克隆复制实战
  • Docker 私有仓库恢复实例详解
  • Docker基础学习之数据管理
  • docker 容器上编译 go 程序提示找不到文件问题

文章分类

  • windows
  • 服务器硬件
  • 服务器运维
  • 云计算
  • 虚拟化
  • IIS教程
  • Linux
  • Apache
  • Ftp
  • DNS
  • Nginx

最近更新的内容

    • docker中搭建overlay 网络实验环境
    • 详解Docker数据管理(数据卷&数据卷容器)
    • Openstack 使用migrate进行数据库升级实现方案详细介绍
    • 详解在Docker容器中运行Spring Boot应用
    • Nucth学习笔记(一),Nucth学习笔记(
    • Dockerfile 指令 ADD 和 COPY介绍
    • docker 如何搭建私有仓库(ubuntu 14.04,Docker版本1.6.4)详细介绍
    • VMware虚拟机CentOS系统网络设置
    • 使用docker -v 和 Publish over SSH插件实现war包自动部署到docker的操作步骤
    • docker centos7 安装ssh具体步骤

关于我们 - 联系我们 - 免责声明 - 网站地图

©2020-2025 All Rights Reserved. linkedu.com 版权所有