ML_DM
学术科技 · 当前来自首页固化板块目录。
有没有之前参加过阿里大数据竞赛的小伙伴儿?求淘宝日志数据集,做电商用户行为分析用,在网上找了好长一段时间怎么都找不到。
之前为了安装scikit-learn,折腾了半天,也没搞定,后来有教程推荐Anaconda套件。 Anaconda安装成功后也将 Pycharm 中的 Project Interpreter 改为 Anaconda 中的Python。 在命令行里运行调用第三方模块并不报错,但是在Pycharm中,只要import sk…
本人目前在做毕业设计,题目是关于文本情感识别的。任务量不重,但是进度很紧,需要大神协助我做一下。历时一个月左右,事成之后报酬至少2000.如果做的好可以多加酬劳。 有意者请加微信zhonghao-zhao
老板让看tensorflow的源码,但是这货是用bazel构建的,但是好像没有IDE支持这种工具用idea导入工程之后连跳转都跳不起来有没有在看源码的同学指点一二,这种蛋疼情况怎么处理?
目前用神经网络做一个分类,输出层(1,0,0)表示第一类,(0,1,0)第二类,(0,0,1)第三类这样设计的label,但是训练完之后发现我的网络无论在训练集还是测试集上的输出结果都是近似于(0.33,0.33,0.33),代价函数就是简单的平方差加上regularization项,不管用深的还是浅的网络试过好像差别…
本人byr信通院研二学生,由于实验室项目需求,现需要一些会搭大数据挖掘平台的同学(或者会linux,hadpoop streaming,java/C++都行)。 如果你是研三的师兄师姐,并且现在比较清闲,欢迎您来这边做指教;如果你是研一或本科的同学,对大数据挖掘有兴趣,并有一定基础,想要锻炼自己的能力,这绝对是一个很好…
我又改了一下,改成每条数据是如下格式: [1] "小米 新品 发布会 明天" 错误是说词的重复 rf<-randomForest(y~.,data=x,ntree=100,proximity=TRUE) Error in terms.formula(formula, data = data) : 在数据框里用'.'时不…
目的:对1行5列的向量训练计算出5列的权重,当输入[0,1,1,1,0]时,根据权重表C输出2,3,4列中权重最大的那列标为1,其他标为0; 例如,假设训练后该向量的权重表为C{5,4,3,2,1},那么输入A=[0,1,1,1,0]时,自动输出B=[0,1,0,0,0],因为仅有4,3,2三个权重有效,并且权重4最大…
PDF Slide: https://www.cs.cmu.edu/~muli/file/mxnet_gtc16.pdf Keynote: https://www.cs.cmu.edu/~muli/file/mxnet_gtc16.key
【 以下文字转载自 buptAUTA 讨论区 】 发信人: wxy233 (木野狐), 信区: buptAUTA 标 题: 【讲座】机器学习&数据挖掘 系列学习活动(第一讲)! 发信站: 北邮人论坛 (Wed Apr 6 12:54:57 2016), 站内 ------------------------------…
小白一个,刚开始学spark,用三台虚拟机搭建了一个两个slaves的spark,用来地区一个1g的本地csv文件,以textfile方式读取,然后saveasdataframe,结果读了两个小时还没读完,一直在报错,果断kill掉了。但是换了个小文件读就没问题,求大神帮忙看看哪有问题,学渣是在是搞不定了[em70],…
就是在google翻译的时候会出现的修改建议,去学习用户的修改以提升算法的效果。最近想做一些有关的东西,但是不知道这种场景下的算法的专业名词是什么?求知道的同学告知或者提供一两篇可用paper[ema3]
小弟我用的是MAC 安装SKLEARN库之后,跑了一下kaggle上的代码,在引用库这里就出现了这个问题 from sklearn.pipeline import make_pipeline 运行提示 No module named sklearn.pipeline 可是我明明安装了最新版的sklearn啊 为什么提示…
同志们,如果你还没有上研究生,我只想说一句,谨慎选择导师,不要求导师多牛逼,只是起码最基本的师德要有~ 【 在 ly920426 的大作中提到: 】 : 一个连最基本的测试集的概念都不知道的导师,强行秀了一小时的机器学习,最后一脸你是傻逼吗的表情看着我问,现在你还有什么问题?妈的,听完你说的都是问题好不啦~根本就没有这…
根据官网提示安装了nanconda 然后在终端输入IPYTHON=1 IPYTHON_OPTS="--pylab" ./bin/pyspark 提示如图: 大神们求助