Weka使用之聚类分析
(2010-07-04 20:53:19)
标签:
weka聚类杂谈 |
分类: 学术研究 |
转自:http://anna-zr.javaeye.com/blog/578938
上次我介绍了分类器的使用方法,这次我来介绍一下聚类算法。聚类算法在数据挖掘里面被称之为无监督学习(unsupervised
learning),这是与分类算法(supervised
learning)相对的。在它们两者之间还一种叫做半监督学习(semi-supervised
learning)这个我会在后面的文章中重点介绍。所谓无监督学习就是在预先不知道样本类别的情况下,由聚类算法来判别样本的类别的一种学习方法。
聚类算法的一般过程分为:
1.
2.
3.
4.
我们来看下面的一个实例:
package com.csdn;
import java.io.File;
import weka.clusterers.SimpleKMeans;
import weka.core.DistanceFunction;
import weka.core.EuclideanDistance;
import weka.core.Instances;
import weka.core.converters.ArffLoader;
public class SimpleCluster {

加载中…