ML_DM
学术科技 · 当前来自首页固化板块目录。
你好,我是你们学校附近公司的创始人,项目刚获得500w投资,项目是以数据挖掘机器算法为核心的项目。项目简介:媒体,社交,移动,分享这几个关键词。目前公司刚开始没多久,现在组建初创团队,初创团队有股份和薪资待遇。欢迎迎接或者在校有时间的大学生实习,如果看中我们希望留在公司。我的联系方式郭文刚,15302059087.qq…
~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~说明~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~~ 写的这个东西本来是心血来潮,自娱自乐,没想到结果还不算太差,就发上来轻松一下,没想到上十大了。可能做法缺乏理论依据,也不甚科学,而且我本身对SVM了解也止于表面,所以说明一下,大家不…
第一张图下面的w0为什么可以这样推?还有第二张图片的画线公式是怎么来的?
前提假设: 假设眼睛正向。以眼睛中心为坐标原点,垂直上方向为Y+轴,水平右方向为X+轴。将虹膜区域从90度沿逆时针展开成矩形区域。对所有的训练样本都采用这种展开方法。假设展开的矩形为60*120.然后将这个矩形分割成10*10的小块,那么就是6*10个小块。计算每个小块的直方图均衡度,那么可以得到60个值。 问题来了:…
行业背景:我们是一家做手机阅读的公司,在线热销图书十万本,每日活跃用户千万。 应用场景:对现有图书根据图书内容打相关的标签 现状:现有图书的标签均由人工手动添加,具有工作量大,标签不准确的缺点。 解决方案: 对现有图书进行隐语义挖掘,找出所有图书的隐性主题。根据图书集的隐性主题来构造 图书的标签。 具体算法决定使用LD…
推荐最近出的一本3D智能数字化与3D打印的新书:《3D打印:三维智能数字化创造》(3D Printing: Three-Dimensional Creation via Intelligent Digitization),详细介绍见: http://www.sigvc.org/why/book/3dp/index.ht…
里面的题目不会做哎
原文地址:点我
工作的需要写了个针对中文文档去重的simhash算法库(C++),感觉还挺好用的。 有需要的同学欢迎fork。
如题,我是这么感觉的,网上查了查,所除的分母应该不是经验熵H(D),而是一种叫内在信息(Intrinsic Information)的东西 http://blog.csdn.net/athenaer/article/details/8425479
word2vec注释:有错请指导。。 1、多线程并行处理: 1、分配内存空间,创建多线程,执行多线程。malloc,pthread_create,pthread_join 2、每个多线程处理的训练文档根据线程id,分配不同的文档内容,由fseek定位 2、vocab相关: 1、每个vocab对象都含以下内容:词(cha…
通信网流量预测之前要先进行流量分类码!? 看到有书上写根据流量特征分类是基础工作 求指点
为什么后面那个有1/m?
现在已有类似大众点评的网站数据,每个餐厅有很多评价,要找出最能代表这个餐厅的三条评价。已知数据中把每条评价分为几句,分别做了好中差的标记。这个要用什么算法啊,初学有点没头绪,求指点。
最近想用腾讯微博提供的SDK里的api接口来爬数据,但是对认证使用这里有问题。我现在获得了access_token,如何进行认证然后调用sdk里的api借口呢?或者应该怎样进行认证然后一直调用接口呢? 跪求指导,多谢!