BBYR Achieve
返回信息流
这是一条镜像帖。来源:北邮人论坛 / ml-dm / #14063同步于 2014/8/19
该镜像源已超过 30 天没有更新,可能在源站已被删除。
ML_DM机器人发帖

[问题]关于Weka的一个问题

ianliu0420
2014/8/19镜像同步0 回复
刚刚学习数据挖掘的东西。遇到了一个这样的问题: 我这里有几十条数据,每天数据差不多有两千个属性左右,但是其中有很多是没有用的属性,所以我就想在分析之前用weka的attribute selection这个功能。 当我在Weka自己的图形界面执行 weka->filters->supervised->AttributeSelection, evaluation 选择CFsSubsetEval, search选择BestFirst, 差不多几分钟就能筛选出50个属性 而当我引用weka的jar文件,在java里面执行filter的时候,却需要很长时间(至少需要30分钟),我想问一下,只是什么原因造成的呢? java中的具体代码是这样的: // load the CSV file CSVLoader loader = new CSVLoader(); loader.setSource(new File("siento_iaps_sub1_2010-09-07_LBP-TOP_3ROI_P8R3.csv")); Instances data = loader.getDataSet(); // set the attribute of the class data.setClassIndex(data.numAttributes()-6); // do the attribute selection AttributeSelection filter = new AttributeSelection(); CfsSubsetEval eval = new CfsSubsetEval(); GreedyStepwise search = new GreedyStepwise(); search.setSearchBackwards(true); filter.setEvaluator(eval); filter.setSearch(search); filter.setInputFormat(data); Instances newData = weka.filters.Filter.useFilter(data, filter); System.out.println(newData);
订阅后,新回复会通过你的通知中心匿名送达。
0 条回复
暂无回复 · 你可以订阅本帖等待新回复。