ML_DM
学术科技 · 当前来自首页固化板块目录。
目前可以很容易地实现对3维以内的数据聚类,但是高维数据的聚类应该怎么处理,而且聚类之后的效果显示更是一个问题,大家怎么看,具体方法!
lz现在有种需求,想把个人十大帖子全部收集起来,可以怎么做呢? 楼主自从入了bupt的佛门,十大帖子有不少,想专门收集起来。 不想一个一个地粘贴,那样也太麻烦了。 各位byr大牛,能用技术手段解决这问题不?或者找管理员商量?
自然语言处理的社交文本规范化是我的博士研究方向,不知道学校里还有没有方向相似或者对这个方向感兴趣的小伙伴。如果有的话可以私信我,大家交流一下各自的想法和心得。 简单来说社交文本规范化就是将下面的文本: idk wt u talmbout 转化成标准形式 i don't know what you are talking…
雅虎开源了一个爬虫软件Anthelion,已经下载,求怎样安装和使用
rt,这个我没有搜出来,求指教一下这个是啥意思!谢谢
------------------------------------------------------------- 北邮数据挖掘竞赛 Day10 线上赛终结日赛况播报 竞赛线上赛正式完结,最终成绩产生,下面是排名前十的队伍。 http://ww1.sinaimg.cn/large/005GTGAngw1ezhy…
题目: 求会R的同学指导,如何将数据框中特定的某几行提取出来? 内容:
r语言,python,c++,java 在数据挖掘,机器学习,自然语言处理之类的工作中,用的多吗?尤其是r语言,目前是一个什么样的状况?
现在遇到这样一种很蛋疼的情况: 给出了一些行业类型,类型非常细,比如: 公司搬家 小件搬家 长途搬家搬运 管家 金属回收 etc... 然后是用户的query,特点是短,信息量非常少而且没有标签,而且非常非常非常多,需求是需要在这些query中找到符合上面行业特征的query(也就是一个分类问题) 由于没有标注,所以如…
求问各位大神,大家知不知道招聘类的公开数据集(用户信息,企业信息等等)?找了好多都没找到,难道要自己去爬??!!
研究者July在计算机和机器学习领域的水平怎么样? http://www.zhihu.com/question/24957182 一个华东科大的不知道是本科还是研究生的毕业生 教 一群北邮,北航,清华的学生。。。。还各种演讲, 哎。。。 买个代理, youtube上一流的机器学习, 计算机视觉课程一大堆。 【 在 ch…
MFCC八个特征系数提取matlab仿真后的结果是一个25235*8的矩阵吗?25235可能和音频大小有关,不知道这个结果对不对,还有就是和EM算法建立4个混合度的GMM模型,我将刚刚得到的数组输入到EM算法中一直显示数组太大无法运行,已经交了大作业的亲们求指点[ema1][ema1][ema1] 妹子中的学渣求帮助[…
问题:目前在做微博聚类,对微博分词之后,采用Google开源的Word2Vec进行词向量的训练,每个词对应一个1*N维的向量,然后对微博进行关键词提取,由于微博的长度不一致导致会产生每个微博提取出来的关键词个数不同,怎么才能保证每条微博由关键词词向量构成的特征向量维数一样呢?除了将每个词向量加起来求平均还没有有其他方法…
楼主最近在看机器学习的相关资料,脑洞大开,想要设计一个二值分类器: 输入妹子的照片、以及年龄、家乡、性格等相关信息; 然后以此为依据设计一个二值分类器,判断妹子是不是适合自己。 应该使用什么样的分类算法。。。? [ema0]
如果不考虑ResNet的话,首推fast/faster rcnn