返回信息流模糊聚类的问题,主要是前期数据处理的问题?
比如,如果A,B……样本很多,每个的样本得好几十个,怎么处理,
最终是将A,B……做聚类,但是对于样本很多的时候,前期数据如何处理?还是不用处理,直接扔进去,让它自己聚类?那样的话,如果标记哪个样本是A的,哪个样本是B的,即哪个样本是谁的呢?
这是一条镜像帖。来源:北邮人论坛 / ml-dm / #9508同步于 2012/9/19
该镜像源已超过 30 天没有更新,可能在源站已被删除。
ML_DM机器人发帖
聚类问题,求解答
homeless271
2012/9/19镜像同步19 回复
订阅后,新回复会通过你的通知中心匿名送达。
9 条回复
这个模糊聚类和聚类差不多吗?A,B样本是什么意思?
【 在 homeless271 的大作中提到: 】
: 模糊聚类的问题,主要是前期数据处理的问题?
: 比如,如果A,B……样本很多,每个的样本得好几十个,怎么处理,
最终是将A,B……做聚类,但是对于样本很多的时候,前期数据如何处理?还是不用处理,直接扔进去,让它自己聚类?那样的话,如果标记哪个样本是A的,哪个样本是B的,即哪个样本是谁的呢?
差不多,就是问的数据如何处理
是说 A ,B……的某个特征 有N个采样值
【 在 caleb 的大作中提到: 】
: 这个模糊聚类和聚类差不多吗?A,B样本是什么意思?
: 最终是将A,B……做聚类,但是对于样本很多的时候,前期数据如何处理?还是不用处理,直接扔进去,让它自己聚类?那样的话,如果标记哪个样本是A的,哪个样本是B的,即哪个样本是谁的呢?
额,还是不太理解,假如是已知A,B的某个特征的n个采样值的话,你聚类的目的是干嘛,是把A,B这些东西聚成几类?那样的话你是要把A的n个采样值处理出一个参与聚类还是全部参与?
【 在 homeless271 的大作中提到: 】
: 差不多,就是问的数据如何处理
: 是说 A ,B……的某个特征 有N个采样值
:
要是只是为了知道哪个样本是A的,那输入数据时给数据一个与A相关的命名不就可以了?
【 在 homeless271 的大作中提到: 】
: 模糊聚类的问题,主要是前期数据处理的问题?
: 比如,如果A,B……样本很多,每个的样本得好几十个,怎么处理,
最终是将A,B……做聚类,但是对于样本很多的时候,前期数据如何处理?还是不用处理,直接扔进去,让它自己聚类?那样的话,如果标记哪个样本是A的,哪个样本是B的,即哪个样本是谁的呢?
我也不知道 把A的n个采样值处理出一个参与聚类还是全部参与
【 在 caleb 的大作中提到: 】
: 额,还是不太理解,假如是已知A,B的某个特征的n个采样值的话,你聚类的目的是干嘛,是把A,B这些东西聚成几类?那样的话你是要把A的n个采样值处理出一个参与聚类还是全部参与?
额,这个不是根据你自己的目的自己决定的吗?
【 在 homeless271 的大作中提到: 】
: 我也不知道 把A的n个采样值处理出一个参与聚类还是全部参与