随笔分类 -  学生时代10(不再编辑)

摘要:KMP算法作者:海子 出处:http://www.cnblogs.com/dolphin0520/ 本博客中未标明转载的文章归作者海子和博客园共有,欢迎转载,但未经作者同意必须保留此段声明,且在文章页面明显位置给出原文连接,否则保留追究法律责任的权利。 KMP算法在介绍KMP算法之前,先... 阅读全文
posted @ 2014-09-26 13:43 二郎那个三郎
摘要:Trie树作者:海子 出处:http://www.cnblogs.com/dolphin0520/ 本博客中未标明转载的文章归作者海子和博客园共有,欢迎转载,但未经作者同意必须保留此段声明,且在文章页面明显位置给出原文连接,否则保留追究法律责任的权利。 Trie树 Trie树也称字典树,... 阅读全文
posted @ 2014-09-26 10:52 二郎那个三郎
摘要:1.String/Array/Matrix在Java中,String是一个包含char数组和其它字段、方法的类。如果没有IDE自动完成代码,下面这个方法大家应该记住:toCharArray() //get char array of a StringArrays.sort() //sort a... 阅读全文
posted @ 2014-07-22 13:21 二郎那个三郎
摘要:官冲拉手网CTO举了个EDM(邮件营销)的例子: 在做大数据分析应用之前,通过EDM带来的订单转化率很低。在采用大数据解决方案后,可以根据用户之前的浏览习惯猜测他的喜好和购买习惯,从而针对性的推送个性化的EDM,从来带来的订单转化率能提高十倍以上。 阅读全文
posted @ 2014-07-22 13:16 二郎那个三郎
摘要:来自百度百科的解释: Graph Search为2013年1月16日,Facebook首席执行官马克·扎克伯格(Mark Zuckerberg)在门罗帕克公司总部召开的新闻发布会上宣布推出社交搜索工具,称其是能找到与Facebook用户最具相关性的人、照片、地点和兴趣的一种新方式。 这种工具的搜... 阅读全文
posted @ 2014-07-22 10:58 二郎那个三郎
摘要:1. 归并排序(MERGE SORT)、快速排序(QUICK SORT)和堆积排序(HEAP SORT)哪个排序算法效率最高?这要看情况。这也就是我把3种算法放在一起讲的原因,可能你更常用其中一种,不过它们各有千秋。归并排序算法,是目前为止最重要的算法之一,是分治法的一个典型应用,由数学家John ... 阅读全文
posted @ 2014-07-22 09:34 二郎那个三郎
摘要:1、余弦距离余弦距离,也称为余弦相似度,是用向量空间中两个向量夹角的余弦值作为衡量两个个体间差异的大小的度量。向量,是多维空间中有方向的线段,如果两个向量的方向一致,即夹角接近零,那么这两个向量就相近。而要确定两个向量方向是否一致,这就要用到余弦定理计算向量的夹角。余弦定理描述了三角形中任何一个夹角... 阅读全文
posted @ 2014-04-15 11:56 二郎那个三郎
摘要:如果一个信号序列是高斯白噪声的,那么它就是服从高斯分布的。我们根据这个噪声序列的样本均值和样本方差,去点估计出它的高斯分布均值mean和方差variance。那么,高斯分布有这样一个性质,就是在以均值为圆心的3倍标准差半径内的区间上,取得数据的概率是:0.9974. 阅读全文
posted @ 2014-04-12 20:42 二郎那个三郎
摘要:冯老师,给我上过课,那应该是他退休前最后一次教学吧。很惭愧,我不是一个好学生,上课不大喜欢认真听讲。只是,到了学期即将结束时,要求交一篇论文。我才开始阅读,了解,部分理解冯老师的理论。冯老师,是搞数学出身的,所以上课时什么公理化教学很擅长;老人家经历比较多,所以上课非常生动风趣。冯先生,后来转向了人... 阅读全文
posted @ 2014-04-12 19:58 二郎那个三郎
摘要:放苹果Time Limit:1000MSMemory Limit:10000KTotal Submissions:24985Accepted:15908Description把M个同样的苹果放在N个同样的盘子里,允许有的盘子空着不放,问共有多少种不同的分法?(用K表示)5,1,1和1,5,1 是同一... 阅读全文
posted @ 2014-04-04 11:06 二郎那个三郎
摘要:最近遇到一个问题,如果因变量为一个连续变量(如胰岛素水平),主要考察的变量为分组变量(如正常血糖组,前糖尿病组,糖尿病组三组),现在的目的是想看调整多种变量(包括多个连续性变量和分类变量)后,胰岛素水平是否一致。一开始的思路想到的是采用GLM进行协方差分析来解决。但是有觉得似乎不是很对,因为经典的协方差分析通常只考虑一个连续变量(协变量)和一个分组变量,同时协变量和分组变量只有不存在交互的时候(经典协方差分析的前提)才能使用协方差分析。针对我目前的问题,如果想调整多个连续性变量和分类变量,这种方法能否再叫协方差分析?如果可以认为是协方差的思想,用不用检验协方差分析的前提(如协变量与分组变量之间 阅读全文
posted @ 2014-04-02 16:20 二郎那个三郎
摘要:1.样本矩阵 如果是一个随机变量,那么它的样本值可以用一个向量表示。相对的,如果针对一个随机向量,那么就需要利用矩阵表示,因为向量中的每一个变量的采样值,都可以利用一个向量表示。 然后,一个矩阵可以利用行向量组与列向量组进行表示。2.数学期望和方差的定义3.协方差的定义式4.协方差矩阵的定义参考:http://blog.csdn.net/itplus/article/details/11452743 阅读全文
posted @ 2014-04-02 13:02 二郎那个三郎
摘要:引言 Introduction 需要特别说明,spm是每一个体素为单位,计算统计量,进行t检验。1.分别在每个体素上做方差分析;2.对每个体素的方差分析结果,计算t检验统计量;3.计算等同于t检验统计量的z值;4.绘制一副t检验统计量map,或者z值map;5.利用随机场理论,纠正统计检验结果的显著性水平。 命名说明Naming of parts observation = a voxel value, in the voxel we are analysing, for one scan; 观测值 = 就是图像中的一个体素值; response variable = data for... 阅读全文
posted @ 2014-03-30 20:26 二郎那个三郎
摘要:方差分析参考:http://wiki.mbalib.com/wiki/%E6%96%B9%E5%B7%AE%E5%88%86%E6%9E%90方差分析(Analysis of Variance,简称ANOVA)什么是方差分析 方差分析(ANOVA)又称“变异数分析”或“F检验”,是R.A.Fister发明的,用于两个及两个以上样本均数差别的显著性检验。 由于各种因素的影响,研究所得的数据呈现波动状。造成波动的原因可分成两类,一是不可控的随机因素,另一是研究中施加的对结果形成影响的可控因素。 一个复杂的事物,其中往往有许多因素互相制约又互相依存。方差分析的目的是通过数据分析找出对该事物有显... 阅读全文
posted @ 2014-03-28 11:06 二郎那个三郎
摘要:参考:http://emuch.net/html/201102/2841741.html首先是目的不同。F检验用于比较两种分析方法是否存在显著差异(单边检验)或者两种方法紧密度是否存在差异(双边检验),我记得老师说是用于检验新方法是否可行,相当于系统误差。而T检验是利用统计量t,检验操作是否存在误差,或者不同人(不同实验组)之间是否存在误差。按这种说法,如果为了彻底检验新方法,就得必须先做F检验,再做T检验(不存在系统误差方法才可行)。简单的说T检验时检验平均值的,F检验时检验标准方差的。第二个就是精度不同。这个我记不清了印象中F检验成功,T检验可能不成。按上边说法,说点个人理解。lzF检验没 阅读全文
posted @ 2014-03-28 11:02 二郎那个三郎
摘要:1.什么情况下,应用t检验1. 已知总体的均值m,或者我们假设了一个总体均值m;2. 我们知道样本的个数n,样本的的方差var,样本的均值m;3. 我们假设总体,或者样本都是服从正太分布的。2. 我们的目的,就是要检验这个总体均值m是否合理 3.具体步骤:参考:http://wiki.mbalib.com/wiki/T%E6%A3%80%E9%AA%8CT检验的步骤 1、建立虚无假设H0:μ1= μ2,即先假定两个总体平均数之间没有显著差异; 2、计算统计量t值,对于不同类型的问题选用不同的统计量计算方法; 1)如果要评断一个总体中的小样本平均数与总体平均值之间的差异程度,其统计量t值... 阅读全文
posted @ 2014-03-28 10:40 二郎那个三郎
摘要:工具箱下载:http://leelab.googlecode.com/svn/trunk/apps/drtoolbox/————————————————————————————————————————————参考:https://chunqiu.blog.ustc.edu.cn/?p=413 这个工... 阅读全文
posted @ 2014-03-28 10:26 二郎那个三郎
摘要:1.应用pca的前提 应用pca的前提是,连续信号具有相关性。相关性是什么,是冗余。就是要利用pca去除冗余。2.pca的定义 pca是一种去除随机变量间相关性的线性变换。是一种常用的多元数据分析方法。pca将互相关的输入数据转换成统计上不相干的主成分(或者特征),所得到的主成份通常是按照方差大... 阅读全文
posted @ 2014-03-28 09:46 二郎那个三郎