ML_DM
学术科技 · 当前来自首页固化板块目录。
mapreduce中,map的定义是这样的protected void map(LongWritable key, Text value, Context context); 资料里说key指的行号。 一般大文件都会被分割成N个小文件,存在HDFS中,我想问的是,这里的key指的是该记录位于大文件中的行号呢 还是 每个…
【 以下文字转载自 buptAUTA 讨论区 】 发信人: wxy233 (木野狐), 信区: buptAUTA 标 题: 【数据引领 飞粤云端】2015广东公共交通大数据竞赛预热中! 发信站: 北邮人论坛 (Thu Nov 5 22:25:13 2015), 站内 数据引领,飞粤云端! 2015广东公共交通大数据竞赛…
楼主研二正在开题阶段,做的是深度学习图像方向。现在觉得如果纯做学术发paper有点难度,而且不太利于就业(毕竟没人带这么短时间也发不出什么太高质量的论文)。 所以想结合点工程,希望能够工程算法相结合,既锻炼编码能力又能更理解运用算法。尤其出来的mxnet,caffe都是很优秀的能学习的代码。这样也有利于找工作,否则一直…
SenseTime 深度学习系列讲座 10-11 月,8 名 SenseTime 科学家于清华大学授业解惑人工智能核心 — 深度学习:深入解析深度学习前沿趋势 / 顶级科学家畅谈学术心得 / 剖析学术成果实践应用案例。 2015年,人工智能开始成为一个频繁出现在人们生活中的关键词,智能汽车、智慧家居、智慧城市、智能穿戴…
自己一个人搞hadoop,心力憔悴啊,有没有做过的同学或者兴趣交流群,求收留
CIKM也还行啊, 计算机科学与技术学科列表会议,在信通院评国奖竟然不算,按照普通EI折算。也是醉了。 略有不甘啊…
本人大三通信工程专业,在参加数学建模的比赛中,突然发现自己对数据相当感兴趣,就是统计学、数据可视化等等。大三了,如果选择保研应该没问题,但也还在考虑要不要出国。但无论选择哪个,以后继续深造希望研究数据挖掘方面,加之目前课程不多,想进入实验室对数据挖掘方面多一些了解,提升能力,为保研或出国打点基础吧。 希望学长学姐可以推…
大家好,本人目前在某大型互联网公司从事深度学习的研究工作,是在某搜索场景下的推荐和预估,目前最优效果在0.7,工作内容就是一顿的调参和尝试,但是迟迟没有任何进展和显著的提高。想问一下大神们职业发展路径如何呢?
是这样的,现在我有几个最后的模型,但是我想做一次ensemble,网上有有些方法,比如投票,还有权重,但是在赋予权重的方法有点想不明白,因为是分类的模型,而且最后的分类有20个,因此感觉附权重的话,最后的结果可能会出现模型分类成为浮点数的问题,有没有人给点指导,有没有比较ensemble的方法,求大神指教啊!!!
【更新:北邮组团报名的qq群: 511639468。有疑问的到群里讨论报名事项。添加群请备注北邮人。 同时也抱歉平时事比较多,没注意看大家的疑问。】 【文章开始之前先说一些完全【免费】的大数据视频资料】 (马上的【中国大数据技术嘉年华】的资料可能也会有,具体待定)(会开放越来越多的【免费】大数据资料的,对大数据感兴趣的…
就是可以多台主机的那种 不是只有多个线程那样的 支持么
RT 离校多年,不知道情况,特来贵版咨询,请大家帮忙解答。 如果有的话能给个联系人和联系方式最好。 非常感谢。
最近写代码遇到这个问题,之前用过特征值(EVD)分解。 (1)对EVD来说,得到最大的K个特征值对应的特征向量很简单,因为特征值分解A=UDU~,~指的是逆,最大的K个特征值对应的特征向量矩阵就是U的左K个列向量。 (2)但对SVD来说,A=UDV',分解后从D中也容易得到最大的K个奇异值,但是这K个奇异值对应的特征向…
如题。 在分类的问题里,如SVM、决策树,在公司实习时,前辈的经验说训练样本数至少应该是特征数的10倍,才不会出现过拟合等情况。 但是最近在看一些资料时,表示工业界一般实际应用分类器时,像百度这样的公司,都会取很多的特征,可能上万个?真的需要那么多的特征吗?而一般情况都是特征数会比训练样本多这样子吗 求教有实际大数据应…
天池黄金联赛--巅峰之战:淘宝穿衣搭配算法 这是一次结合图像数据和电商推荐算法的深度探索! 这是一次与海量淘宝用户行为及商品数据的亲密互动! 在这里,不仅有高效处理海量数据的ODPS平台,还有高性能的GPU集群,更兼众多可供调用的机器学习深度学习算法包。 各位数据英雄,还等什么,快登陆天池官网报名吧!更有万元大奖等你来…