ML_DM
学术科技 · 当前来自首页固化板块目录。
小弟只知道北邮模式识别实验室,请教学长们还有哪些实验室呢?[em17]
spark运行时随着数据规模的增大,单个executor所需要的内存大小也需要增加,这样是正常的吗?[ema13] 当然不会随规模线性增长,但还是需要相应调整,比如 在处理百万条数据时,单点内存需要20G,在处理千万条数据的时候,单点内存需求就增大到40G,不然就各种fail,请问这是正常的吗,还是程序对数据处理的不够…
先谢过大神们啦!!! 刚刚接触hadoop不久,把hadoop的重要概念和基本语句熟悉了,正在看《Hadoop The Definitive Guide》这本书,想找点实际的例子和projects边看边练手,不然光看理论无法很好理解 求推荐合适的博客,中英文都可以。 非常非常感谢![ema3]
如下图,在训练34层resnet时,在训练进行到一定程度时,训练集上的loss总是在每个epoch上下降,而第二个eopch开始时又会重新开始断崖式下降,从实验现象看似乎是越接近过拟合这种现象越明显,why? 附 test loss
题目: CNN中池化层方法求教! 内容: 池化层最常用的是最大池化,是不是没有需要更新迭代的参数,只需要步长提前设置好就可以了?那为什么在一篇论文中看到乘性偏置w*下采样函数+加性偏置b去采样,还要对w和b进行更新?表示很不懂,求大神解答,非常谢谢!
目前在学深度学习,小白一个,学的tensorflow,但感觉只会深度学习貌似不太好找工作,再学点什么比较好找工作呢,能和深度学习配合着的方向最好。就是为了好找工作,因为技术比较渣,求教。
刚借了一个宏基本,手动按了一个ubuntu,就是默认配置下来的,啥驱动也没按 想着配个tensorflow、keras的运行环境 查了一下如果想要GPU加速,需要安装nvidia的显卡驱动吧? 这本本好象是个双显卡,机身贴了一个nvidia GTX 960M的一个标签 应该如何配置GPU加速呢? 网上搜了一下ubunt…
如题
如题,lz好久没看了,生疏了很多。想问:为什么发送的一句话,统计出来的单词计数会不同~,谢谢~~~!
有做广告的吗?求一道问题:广告投放策略,不同的广告语有不同的投放要求,怎么将各个广告主每天的预算尽可能地花完
按提交要求,提交的是一个csv文件,内容也是按示例上写的,但每次提交都显示格式错误 请问做这个比赛的同学,有没有遇到过这个问题
前几天去面试被问了个随机森林的问题,一直找不到答案,求解答~ 随机森林有n棵树,每棵树的准确率为60%,请问最后随机森林的准确率为多少???
An Introduction to Probabilistic Graphical Models (draft version) by Michael Jordon 只有ps格式的 哪位看能不能转成pdf的 附件(3.9MB) jordan_GMbook_nov2003.part1.rar
RT
初学spark,看到14年spark在Sort Benchmark比赛中利用23分钟完成了100TB的数据,很好奇spark是怎么处理这么大数据的; 1、对于这种超大数据,spark是尽量利用内存运算,每个task在内存能够容纳的范围内尽量读取数据;还是每个task读取不管内存能不能够承受,每个task都处理固定大小的…