ML_DM
学术科技 · 当前来自首页固化板块目录。
可以通过微信扫一扫开始聊天,虽然很傻,作为第一个模型还不赖,目前也想到了一些优化办法。 我使用了TensorFlow, 模型基于RNN和LSTM. 很愿意有这个方向研究的朋友一起交流! hailiang.hl.wang#gmail DOT com http://7xkeqi.com1.z0.glb.clouddn.co…
题目: 有人用过Hawk吗,小白求教用hawk爬取豆瓣短评时翻页的问题 内容: 数据挖掘小白,看了之前赵学长抓取链家网的案例,链家的URL是在最后有个pg/,然后在合并多列时改成pg{0}就行了,但是豆瓣短评的URL(以你的名字为例)第一页是:https://movie.douban.com/subject/26683…
对全国大学生智能互联创新大赛感兴趣,希望志同道合的小伙伴一起组队参赛呀,可以一起学习,不求获奖,有宝贵的参赛经验也是很难得的,靠谱的小伙伴私信哦~
本人对机器学习只是稍有了解,不是很懂,特来此问问各位有没有什么好的建议~ 背景:我这里有一个实际的问题,大概一共只有5000多组数据,每组数据的输入是6个,但是输出也是6个(分别对应6种情绪),而且输出的是对6种情绪的打分,在0-10分之间,也就是有11个类。 我看了一些机器学习相关的算法,感觉一般的输出都是1种。所以…
楼主大几?我舍友是艾老师学生。
看到一个面经的问题,里面说“各种核函数,每个是如何实现升维”,这个是怎么回答?他是问那三四个核函数的计算公式?
请问一下有没有人了解在unsupervised learning中有哪些防止过拟合的方法么? 类似与在supervised learning中的early stop之类的.
svm参数也不多吧 发自「贵邮」
网上找有的做的特征图的可视化,有的做图形运算后的可视化结果。到底可视化技术是要展示什么东西呢?求大神们帮帮忙!也不知谁写进项目计划书的。?? 发自「贵邮」
在线等,似乎跟数据挖掘 和算法有关的一个词
帮顶
请教一下,Mac系统能跑Spark不? 跑其他的数据挖掘开源系统有问题吗? 我是小白,对Mac不太了解,谢谢路过的校友~~
这几天在用sqoop1.99.7,想把MySQL的东西转成parquet放到HDFS上,创建了jdbc和hdfs的link成功,创建了转换的job成功,可是job跑不起来,说是input/output路径无效,可是都是按照教程走的[ema1][ema1]小渣心累,求指教 通过『我邮2.0』发布
用朴素贝叶斯做文本分类,发现样本数量差异有点大,最大一类有4000多,最小才40多。用过抽样,复制10倍也才400多,感觉这样过拟合啊,反正效果仍然不好。有两个问题想问问各位大神,第一个是样本不均衡一般都是怎么解决的,第二个是哪些算法对少量样本不是那么敏感。
第二届北邮大数据竞赛求队友,目前共两只研二小伙伴。我们不是大神,只是学的是这个方向。诚心求队友一枚,最好同为研二,欢迎私信。