小白学数据分析------>相关分析之距离分析在道具购买量的应用探索

 

前几天,写过一篇关于相关分析的的文章,很多人都看到了并有很多人在咨询关于这篇文章的一些内容,相关分析是一类很有用的分析方法,如之前所提到的,相关分析由三部分组成,前几日的文章是讲了其中第一部分,第二部分是偏相关分析,第三部分就是复相关分析,说白了其实就是相关分析变量的多少来确定这三部分的。今天这里不谈偏相关分析,以为网友给我截图,问我下面的成交量相关系数的是怎么算出来的,其实这个就是复相关的典型应用,多变量的相关分析。插一句,该图来自于腾讯大讲堂15-市场研究及数据分析理念及方法概要介绍。大家如果需要,请到百度文库或者联系我都OK。

今天将通过Excel和SPSS向大家说说怎么来进行多变量的相关分析,既然是游戏数据分析,那么自然少不了如何利用游戏数据实现多变量的相关分析。在游戏数据分析方面,很多的数据都可以进行相关分析,比如界面按钮的点击次数,今天我们选取游戏道具的购买量进行相关分析。

我们知道游戏道具非常多,换句话说如果进行相关分析,尽管相关分析可以满足我们的计算要求,但是对于我们后期的评估和决策带来非常大不便利,所以这里建议大家做道具的相关分析先进行道具分类,比如FPS游戏中把AK47,M4A1归类为突击步枪,或者再高一个类别,武器,这样在不同的分类维度下进行相关分析,便于我们从不同的高度和角度来进行分析和决策。以下所示为示例数据(模拟),可以看到有7个品类的道具,从101-107,取出来共计10周的数据。

下面我们来看如何通过Excel进行多变量的相关分析。如何打开数据分析,选择相关分析,在上次文章已经提到了,这里不再累述,这里打开一下的对话框。

选择数据,数据区域选择B1:H1,选择好输出区域,点击确定,得到如下的相似矩阵:

有关这个矩阵的分析稍后在说完SPSS的操作再讲解,下面看看SPSS如何进行相关分析。在SPSS中,有专门的模块进行多变量的相关分析。SPSS中针对相关分析的三部分设置了三部分模块进行独立的分析。多变量的相关分析在SPSS中叫做距离分析,相对偏相关分析通过控制一些被认为次要的变量的影响得到两个变量之间的相关系数,距离分析解决的问题更加复杂,因为实际应用时每一个变量都携带了一定的信息,但是彼此在某些方面又是重叠的,举个例子,比如有个变量叫做突击步枪,突击步枪的销售量代表了AK47,M4A1等突击步枪的销售情况和信息,同时突击步枪也属于武器类别,与机枪等类别又有交叉,因为机枪和突击步枪都属于武器类别。

距离分析是对变量之间相似或者不相似程度的测度,通过计算一对变量之间的广义距离,将距离较小的变量归为一类,距离较大的变量归为其他类,这也是为聚类分析、因子分析打下基础。有关距离分析的更多详细内容这里不再累述,大家可以自己百度。

具体操作如下,首先看到SPSS中展示的数据,此为101-107系列道具的销售量:

之后选择分析|相关|距离界面,选择界面如下所示:

弹出对话框,如下所示,将var101-var107选入变量框中,此处最少包含两个变量。

计算距离包括两个两选择项,个案间和变量间,表示输出结果是个案或者变量间距离分析值。度量标准包括不相似性和相似性两个选项以及一个度量按钮。不相似性表示测度方法为不相似性测度。此时如果点击度量,弹出来距离:非相似性度量对话框,如下图所示:

有关该方面知识在这里不作解释和阐述,主要来看距离:相似性对话框的设置,首先如下图所示:

度量标准选择区间|Pearson相关性,转换值标准化|Z得分,其他的选项默认就可以了,这里简单解释一下几个选择的含义。Pearson相关性表示两个值矢量之间的积矩相关性,是定矩数据的缺省相似性测量。转换值是在计算距离之前对变量进行标准化的方法,这里使用Z得分,Z得分表示将值标准化到均值为0且标准差为1的Z得分,但同时注意标准化要指定标准化对象,这里是变量。

在完成以上的设置后,点击确定将会输出结果,上面的为案例处理摘要,下面的为距离分析的近似矩阵。

下面我们结合Excel和SPSS的分析结果来具体分析一下,在Excel的分析结果中,我们发现105系列道具相关性最弱,那么这个品类就需要我们去进一步探究一下。从SPSS的结果来看,105系列道具确实相关性系数较低,其次是103系列道具相关系数也比较低,但是从总体的Excel和SPSS分析结果来看,101与106、102与106、103与105、104与106、107与102相关性很高,这就是我们得出的结论,最后我们来看看这几个类别道具具体指的是什么:

101:突击步枪

102:冲锋枪

103:机枪

104:狙击步枪

105:shouqiang

106:投掷武器

107:近战武器

故而从这里我们再来看一下,大概了解了FPS游戏的玩家作战配置,突击步枪+投掷武器;冲锋枪+投掷武器;机枪+投掷武器;狙击步枪+投掷武器;冲锋枪+近战武器。当然这种配置不是绝对的,还要考虑游戏本身在这方面的设计情况,比如很多游戏主武器是突击步枪,副武器是冲锋枪,这种情况是要结合业务来考虑,而最终我们通过分析得出的结果,也要根据具体的需要进行筛选和调整。

以上是相关性分析的最复杂的一部分,希望解决一部分网友的疑问,这种方法的参考性和实际利用性还需要进一步检验和证明,属于探索内容,请使用者慎重考虑。

参考:

SPSS统计分析从入门到精通 陈胜可著

SPSS18官方文档

时间: 2024-09-13 13:04:59

小白学数据分析------>相关分析之距离分析在道具购买量的应用探索的相关文章

小白学数据分析------>日活跃人数分析

从今天开始,特开辟一个小专栏,题目暂定为小白学数据分析,鄙人不才,在数据分析的道路上走的崎岖坎坷,同时数据分析本身是一个多面和复杂的工作,要懂得理论(统计.概率.数据挖掘.算法.模型)更要懂得业务,懂得行业理论,还要有灵活多变的思维,想想还是很复杂和麻烦的,所讲内容不但是理论,不仅是数据,尽量把这些东西综合起来,立体的来看,鄙人水平有限,很多的内容是尝试和改进,参考了很多的材料,在木有高人指点和牛人帮助的情况下,我只能借助浩瀚的网络知识和自己的悟性,今天决心拿出来给各位主要是帮助大家和我一起进步

小白学数据分析------->相关分析在充值与购买失衡分析的应用探索

昨天简单的说过充值记录的分析方法,今天介绍一下使用相关分析,说说充值与购买的数据相关分析.在很多类型的游戏中,我们经常会做累计充值活动,然而并不是所有的累计充值活动都做的很好,而且某些类型的游戏不适合频繁作累计充值活动,究其原因,其中之一就是会造成充值与购买的失衡,通俗的说就是会存在持币待购的情况,我们希望正常或者良性的循环是充值购买为1:1,这点对于平衡消费,稳定消费结构很重要,当然了实际运营中我们也会面临很多的突发因素,比如游戏内容调整,游戏数值调整,版本IB刺激等等.但是如果出现持币待购也

小白学数据分析----->首次购买记录分析方法

最近几天比较忙,大家都在问如何建立比较完整和有效的数据分析平台,说实话这个问题我考虑了很久,有效并有深度得数据挖掘与分析平台对于游戏产品的质量改善,人气.收益的提升,玩家资源的保有 ,客群分析非常有必要.众多经分系统的好处不在此处解释,且看今天讨论的内容,首次购买记录分析. 在如今道具收费的免费游戏中,首次购买记录的分析发挥着巨大的作用,这与电商的购买不太一样,还是存在很大的区别.道具收费的游戏中,道具购买是我们收益的主体,如何对于道具购买的分析是非常重要的一环. 由于道具收费的免费游戏,玩家存

小白学数据分析----->如何设计和分析数据指标

今天说到的这个题目,看起来有点大,不过作为游戏数据分析师,早晚都要设计和分析数据指标.在<移动游戏运营数据分析指标白皮书>(http://www.xuefenxi.com/forum.php?mod=viewthread&tid=2&extra=page%3D1)中,提炼了一些针对游戏数据分析的指标,这只是分析工作的第一步,还要有效的组织起来,并按照需求进行细分,即按需进行二次设计和分析.白皮书的指标旨在规范大家对于一些最基本最常用概念的认识和学习,有所领悟,有所发挥. 而今天

小白学数据分析-----&gt;从购买记录分析道具支付环节

昨天发现充值异常增高,于是准备做一次详尽的分析,但是当我开始提取数据时,发现了一件比较异常的事情,这是在查询玩家的购买记录时发现的(这是因为往往我们要分析充值时,也要辅助的去看一下当日的购买情况),截图如下: 可以看得到玩家对于该道具的购买需求很高,在一段时间内不断的购买,但是商城不支持批量购买,玩家每次交易只能买一件,然后再次点击再次购买.看到这里,我点蛋疼了. 针对这个问题,昨晚和BOSS聊了一些,就是在讨论商城购买支付环节的问题.总的理解起来是目前的商城购买UI已经是确定符合玩家的习惯的U

小白学数据分析-----&gt; 有关于流失分析的探讨

早先我曾探讨一个关于流失分析的整套流程问题,也说了流失分析是如何的重要,大概这种解说是苍白无力的,因为拿不出数据来说明这个问题,因此大家就会感觉比较飘渺,今天就是流失分析再次进行探讨,这次从数据的角度来理解为什么要做好流失分析. 挽留一个老用户相比于拉动一个新用户,在游戏收入.产品周期维护方面都有好处的,只是我们现在解决用户入口的问题,但是没有重视用户流失的问题.这个问题就好像一个水池子,有进口,但是也有出口,我们不能只关注进口的进水速率,却忽略了出水口的出水速率.这点对应了我们对于指标的量化和

小白学数据分析-----&gt;付费用户的金字塔模型实践操作

免费游戏中付费用户模型分析 最近看了不少文章,对于付费用户的模型也有了很深刻的理解和认识,早先我做了不少关于大R,中间R,低端R用户的分析,想来还是觉得草草了事,近来有网友提出来,理论探讨的多了些,实践上手的东西少了点,毕竟还是叫做小白学数据分析啊,今天就把以前说过的付费用户的模型具体的实践一下. 感悟和理论 得到的灵感首先要感谢Nicholas Lovell 的这篇文章,是我得到了一些处理和分析这个模型的办法.连接如下: http://www.gamesbrief.com/2011/11/wh

小白学数据分析-----&gt;数据指标 累计用户数的使用

小白学数据分析--à数据指标累计用户数的使用 累计用户数是指注册用户数的累计,即可以认为是新用户的累计.在一般的数据统计中,我们基本上都会涉及到这个指标,且这个指标是逐渐累加的,比如: 时间                   注册用户数[新登用户]           累计注册用户数 1日                    100                                                 100 2日                    120   

小白学数据分析之关联分析理论篇

关联分析的学习 在说关联分析之前,先说说自己这段时间的一些感受吧,这段时间相对轻松一些,有一些时间自己自己来学习一些新东西和知识,然而却发现捧着一本数据挖掘理论的书籍在一点一点的研读实在是很漫长,而且看过了没有什么感觉.数据这一行理论很多,算法很多,模型很多,自己现在一直是结合业务来做的数据分析与挖掘,相比电商而言,游戏业做的数据大多很糙,但是仅仅结合业务和运营,更加注重我们客户的质量和维护,当然这不是说电商没做,实际上电商一直在做,然而最近一次经历发现,我们过多的时候去讨论了算法,模型,新理论