版权说明:本文档由用户提供并上传,收益归属内容提供方,若内容存在侵权,请进行举报或认领
文档简介
1、30/30谁是最好的客户?使用SPSS从营销数据库中获得更多信息备注:这是一篇思路特不清晰的市场挖掘方面的文章,要紧侧重于从统计的角度来看待数据挖掘,而不是侧重于从机器学习的角度。特不适合具有统计背景的人员迅速切入数据挖掘领域。美中不足的是没有给出具体的数据如此我们不能按图索骥地将文章中介绍的方法操作一遍。网上也流传一篇由SPSS北京办事处翻译的pdf版,但我觉得依旧原来的英文版讲得详细点。欢迎前来交流营销和数据挖掘 HYPERLINK MSN:mktexchage MSN:mktexchage。摘要本文使用SPSS 的频数分析、描述性分析、缺失值分析、方差分析、卡方检验、交叉表、均值比较、相
2、关分析、线性回归、决策树等统计方法及饼状图、条形图、箱图、散点图、树形图等图表对一个客户数据案例进行分析,以发觉不同客户群体的特征,为市场推广活动提供依据。关键词市场,细分,客户,统计,分析,比较谁是最好的客户?任何行业专业人士市场人员,销售经理,产品开发者和服务专家都乐意回答那个问题。 在当今激烈的市场中,开发,吸引和保留客户越来越困难同时也越来越昂贵。由于这些压力,更多的组织使用营销数据库最大化他们现有的客户价值。转换客户数据为知识和信息的行为是一个有力的手段和企业生存的一项必需的技能。 理解客户的固有特征能够给你有价值的发觉。了解最有价值或至少有利润的客户,他们的购买方式,购买行为和人口
3、统计特征是制订营销打算的关键。较好地理解客户是什么能够关心你开发忠诚的,有持续回报的客户,制订提升销售和交叉销售及营销定位打算。集思广益的决策也是广告,促销,直接邮寄活动和其他营销成功的基础。 有许多方式能够确定最佳客户的特征,也有许多方法可用来度量这些特征。本文讲明使用SPSS实现客户分析的一种方法。 案例营销数据库中包含2000个客户和下列数据: 首次成为公司客户的日期 购买历史不同促销方案的响应率家庭收入地区性不和其它人口统计数据 本文中我们从数据库中析取可控信息,使用各种数据分析技术,从初级的到高级的,目标是依据过去的销售额用人口统计数据来识不不同的细分客户群。即使最一般的过程产生的结
4、果对如何样理解客户也能够产生深刻的含意。不要低估这些方法。用灵活和有力的分析工具结合你的业务背景是从数据中获得有价值信息的最好方法。 首先探究:典型客户是什么样的? 我们通过从数据库中探究不同的变量来回答如此的问题: 客户住在哪里?在三个销售区域中客户的分布如何? 客户的平均收入是多少? 成为公司客户的时刻有多长? 对不同的促销方案,客户平均响应是多少?有多少人响应第一促销方案? 客户花费是多少? SPSS 提供了能够迅速回答以上问题的几种分析方法,频数和描述性分析过程能够提供对客户数据的初步印象。从图1 饼状图中能够看出,东部地区所占比例最大(34%),西部地区最小(19%),而有16.9%
5、的数据未列出所属地区。图 1 和表 1。SPSS自动形成的图表显示最多的客户(34%)生活在东部地区。频数和描述过程特不适合对数据进行原始整理,可能在分析中许多方法都要用这种方法实现。 分析客户住居在哪里关心我们确定销售版图。频数过程提供分类变量计数和百分比表,同时可用条图,直方图和饼图表示数据。SPSS 自动地呈现这些表和图的结果。 从分析中我们能够认识到什么证明是重要的。饼图和表1显示最大的客户群(34%)生活在东部地区,最小的客户群(19%)生活在西部地区。同时有16.9%的客户在数据库中没有列出居住区域。 SPSS 用专门的处理表示缺失数据。明白何时什么缘故信息缺失专门有必要。例如,你
6、可能想区不是因为它们没有涉及而缺失依旧因为它们难以获得而缺失。表1中,“百分数” 包括缺失数据,“有效百分数” 从计算中排出了缺失数据, 能够从表上迅速并行比较缺失数据如何样阻碍结果的。 要得到家庭收入的信息,我们需要几个差不多的统计量作为最初描述统计量。如平均值,最小和最大值,或连续变量,如以美元为单位的收入和以年数为单位的年龄。描述过程为我们提供了一系列汇总统计量。从表2能够看到在2000个客户中家庭收入的平均值大约是 $61,000, 大部分收入范围在 $50,000和 $72,000之间。表2. 描述过程显示平均家庭收入大约是$61,000.要回答“成为公司客户的时刻有多长?” 的问题
7、,我们必须处理一个字段然后计算每个时刻周期的客户数。因为数据库包含第一次成为公司客户的日期,首先计算一个新变量:作为客户的时长。使用SPSS中提供的众多的时刻函数,能够轻而易举地用年数转换成日期计算客户的时长。计算那个新变量后,用时长的频数表来表示客户存在时刻。 表 3. 频数表显示51%的客户存在超过7年。从表 3 看出大约有29%的客户存在10年以上,差不多有过半数的客户在7年以上。接下来,我们要问“谁消费最多?”,最好的客户理所因此是最有利润的客户,或为组织花费最多的客户。 为了得到准确的客户生命周期价值,结合前期购买和客户行为建立预测模型预测以后购买。 本例中,我们开始用总订单金额代替
8、每个客户。首先,建立一个新变量,对数据库中每个订单金额(订单1的金额,订单2的金额等等)求和。因为总订单金额是连续变量,直方图是显示结果的最有效的方法。 图 2. 从直方图能够看出大部分客户消费低于$500,少数几个客户消费量比较大。 直方图的直条代表一个数据范围。在图2中大部分客户消费低于$500,少数几个客户消费量比较大。 每个客户平均消费量是$1,360 ,专门少有客户消费量超过$7,000。当目前为止,我们明白典型的客户是: 生活在东部家庭平均收入为$61,000有七年购物历史 在公司产品和服务上消费 $1,360 客户对不同的促销有如何样的响应? 进行促销分析是理解客户的另一个重要步
9、骤。评估营销打算和促销关心分辨能够做什么能够不做什么。它准确地告诉我们何时及什么缘故某个打算成功,因此你能够拷贝你的成功经验和学习失败的经验。 要回答“每种促销有多少人响应?”和“不同的促销平均响应是多少?”的问题,能够对每种促销响应运行频数分析过程和对四种促销的订单运行描述分析过程。 表 4. 大约有45%,或890人对第一促销方案有响应。 在表4中,有890人,或大约45%的客户响应第一促销方案。对其它促销进行类似的分析,第二促销方案的响应率是39%,第三促销方案的响应率是37.4%,第四促销方案的响应率是17.4%。 那个地点出现一个新问题:在第四促销方案中唯一的特征是它较成功的获得客户
10、响应的缘故吗?换句话讲,这种结果有意义吗?购买历史(表5)信息显示第三促销方案的平均值是$294, 低于其它促销方案。这种差不是否有统计意义还需进一步分析来确定。 表 5. 购买历史分析显示第三促销方案的平均值是$294, 低于其它促销方案。 进一步分析:我们的客户如何样不同?如何样相似? 既然对客户和各种促销的成功有一个差不多的理解,通过观看两个或多个变量赶忙支持这种有力的分析。SPSS 关心发觉用不的方式难于发觉的潜在关系。例如,差不多明白客户在各区域分布和有多少客户响应第一促销方案。接下来要观看各区域响应第一促销方案的客户有多少。通过研究回答这些问题: 每个地区客户生命周期平均是多少?
11、各区域人们如何样响应第一促销方案? SPSS专门容易实现比较不同的分组数据。Crosstabs过程,Means过程, 分段条图和箱图都能够清晰地表示这些结果;当结果有统计意义时,可用卡方统计量,方差分析和CHAID识不。当你明白什么是有统计意义时,这就专门重要了,因为你没有白费你的努力。 下一步探究的问题是“每个区域客户平均生命周期是多少?”。一个强有力的统计图,箱图将均值和数据分布显示在一起。 图3箱图中专门容易看出西部地区客户平均生命周期大于其它地区。 图 3. 箱图将均值和数据分布显示在一起。专门容易看出西部地区客户平均生命周期大于其它地区。 均值比较提供联合分布的汇总统计。表6(包含与
12、箱图相同的信息,但用表的形式)显示总平均时长是 7.49 年,西部地区比东部和中部地区平均占有期长。那个发觉有意义吗?统计显著性告诉你假如差不是随机的,或它们概率值专门大,需进一步分析推断。假如差不是随机的,意味着结果同原假设一样。即变量没有显著性阻碍或对结果没有发生阻碍。 假如差不有统计意义,意味着备择假设成立,表明有非随机因素的潜在阻碍。当统计意义存在时,进一步探究特不必要。 表6. 均值比较报告显示总平均生命周期是 7.49 年,西部地区比东部和中部地区占有时刻要长。 图7的ANOVA表显示区域与时刻周期有统计意义的差不。因为显著性水平是0.000, 或小于0.05,能够得出均值间差不专
13、门可能统计意义的结论:区域和生命周期的差不专门可能不是随机因素引起的而与其它因素有关。可能的缘故是:首先在西部区域开展促销,但在不同的区域有更多的产品需求,或某种产品功能在一个区域成功地促销。了解你的业务,关键数据,支持你的直觉也是专门重要的。 表7. ANOVA表显示各区域有统计意义差不,表明要做进一步的分析。 接着对促销响应进行分析。SPSS使用分段条图将四种促销信息组合在一起,并将其可视化。图4提供按区域响应方式汇总表。可见中部地区同其它两个地区相比订单较少,特不是同西部相比。通过观看区域频数分布可不能得出那个推测,它只告诉我们西部地区包含最少的人口。 图 4. SPSS 分段条图提供快
14、速清晰的方式表达各区域响应方式。 要查明假如这是显著的,我们要进一步按区域探究各种促销结果。要回答“有多少人在各区域响应第一促销方案”的问题,我们在第一促销方案和区域因素上执行交叉表过程。表8显示响应第一个促销方案的人有41.3%来自东部地区(列百分比)。而响应第一个促销方案的人只有26.5%来自西部地区,超过半数(50.5%)的西部居民(行百分比)响应了促销。要理解假如区域确定对第一促销方案可能的响应,比较的是区域百分比(行百分比)并发觉东部地区的居民45%响应了那个促销,中部地区的居民40%响应那个促销。依照那个信息,对第一促销方案,得出西部是一个促销较好销售区域的结论。但是,当百分数看起
15、来不同时,在西部地区启动拷贝第一促销方案就没有充分的理由。首先,我们必须确定这些百分数是否有统计意义。那个地点,假如统计意义存在,卡方统计量能够表示。 表 8. 响应第一个促销方案的人只有26.5%来自西部地区,超过半数的西部居民响应了促销。 表 9 包含区域和第一促销方案的卡方信息。按惯例皮尔松卡方统计量应该小于0.05才有统计显著性意义(在95%的置信水平上)。在那个例子中卡方值是0.007, 所有它有显著性意义。能够有令人信服的理由确信第一促销方案在西部地区比较成功,例如广告语言直接满足客户听觉上的需要,或媒体类型匹配客户视觉需要,吸引客户的眼球。通过识不哪一种活动在西部地区比较成功,能
16、够得到今后在该地区促销的知识。也能够选择探究以区域为基础的任何关系。 表 9. Chi-square 值是0.007 表示各地区在第一促销方案上有显著性的差异。 哪一位客户消费最多? 观看购买历史的另一种方法是评估总消费量而不是只看在单一订单上消费多少。也许总消费量同区域之间的关系能够揭示一些信息。 单因素方差分析给你一个有关平均值有显著性差异的详细信息。 首先单因素方差分析提供一个描述性统计表。表10显示各地区四种促销方案的总消费量平均差不特不大。在中部地区平均消费量是$1,206, 东部地区是$1,391, 而西部地区超过$1,600.报告的最后部分显示东部和西部间消费水平的平均差异没有显
17、著的统计意义。另一方面,西部和中部间的差异有统计意义。能使用这些信息进一步识不这些地区的差不如何及什么缘故,制订营销定位打算。例如,不同的营销和销售混合,不同的促销,或绑定一些产品和服务或许在中部地区会更好。西部地区营销打算在西部重复应该更加成功。 表10. 单因素方差分析显示东部和西部消费水平的差不没有统计意义差不;西部和中部地区的差不有统计意义。 预测总消费量 预测模型是关心定位潜在客户和优化营销资源一种有力的武器。它能关心回答如“按照收入家庭消费占他们的收入多少?”的问题。 在许多统计研究中,目标是用方程建立一种关系,用一个已知变量预测另一个变量。SPSS 提供几个过程建立相关关系定义预
18、测模型,从散点图到相关关系,线性和逻辑回归分析再到CHAID分析。SPSS的指南按部就班地指导,你不必成为统计学家就能够完成这些过程。 图 5. 散点图显示两个变量相关关系。 表11. 相关系数是60.8%,显示在家庭收入和总消费量上有专门强的相关关系图 5 显示这两个变量的相关关系。散点图显示两个连续变量的联合分布。相关系数是60.8%,表11显示在家庭收入和总消费量上有专门强的相关关系。回归分析进一步确定模型的相关关系,如表12和图6所示。这种关系意思是随着家庭收入的增加,购买我们产品的总消费量也增加。 我们能够使用那个模型发觉更好的预测销售和改进营销努力。 表12 和图 6. 线性回归讲
19、明家庭收入和总消费量的关系。收入越多,消费越多。 范例的打算包括:对较高收入的家庭提供较多的产品和服务,或制订客户保留打算关心维持较高收入家庭成为长期的客户,匹配营销资源给潜在收入的细分市场。到现在为止,差不多看到客户所在地区和他们的消费量间的相关关系。同时也看到收入与总消费量有正相关性。 细分有利润的客户群并进行成功的营销。 营销数据库常常使用一种叫做CHAID的技术(卡方自动交互检验)。CHAID告诉我们几个变量什么特征结合专门可能导致什么结果,而不是只告诉我们两个变量间的关系是否有意义。(例如,对促销的响应)。我们输入区域,产品类不,离散化的收入变量到CHAID模型中,去查找哪一种特征结
20、合最可能对第一促销方案产生响应。CHAID自动建立结果树图,如图7所示。 图7. CHAID 呈现哪一个特征结合最可能对第一促销方案产生结果的模型。 图 8 显示根节点的细节,哪些变量对第一促销方案有最显著的阻碍。收入被发觉是最高的预测因子(它对应着前面回归方程发觉)。在这种情况下,CHAID超出回归方程的范围对其进行进一步的交互探究。 图8. CHAID树图的根节点显示收入作为最高响应的预测因子。在图 9中, 下面的树枝显示假如收入水平在第三类($57,750 到 $65,000)同时产品类不在第一类则有73%的响应率。CHAID 在数据库内显示唯一的细分。因此你能够支持特征的组合从营销打算中获得最好的结果。我们发觉家庭收入在$57,750到$65,000的客户(购买第一类产品的客户)专门可能确实是购买第一促销方案的客户。用其它变量作CHAID 分析可能导致其它的研究结果;例如,一般而言,我们发觉中部地区对我们的各种促销响应不行,另外一个收入组的妇女对我们的响应良好,因此对另外的客户群采纳直接邮寄方法也许有效果。 图 9. CHAID 用收入水平的第三类($57,750 到$65,000)和产品分类的第一类划分唯一的细分市场。
温馨提示
- 1. 本站所有资源如无特殊说明,都需要本地电脑安装OFFICE2007和PDF阅读器。图纸软件为CAD,CAXA,PROE,UG,SolidWorks等.压缩文件请下载最新的WinRAR软件解压。
- 2. 本站的文档不包含任何第三方提供的附件图纸等,如果需要附件,请联系上传者。文件的所有权益归上传用户所有。
- 3. 本站RAR压缩包中若带图纸,网页内容里面会有图纸预览,若没有图纸预览就没有图纸。
- 4. 未经权益所有人同意不得将文件中的内容挪作商业或盈利用途。
- 5. 人人文库网仅提供信息存储空间,仅对用户上传内容的表现方式做保护处理,对用户上传分享的文档内容本身不做任何修改或编辑,并不能对任何下载内容负责。
- 6. 下载文件中如有侵权或不适当内容,请与我们联系,我们立即纠正。
- 7. 本站不保证下载资源的准确性、安全性和完整性, 同时也不承担用户因使用这些下载资源对自己和他人造成任何形式的伤害或损失。
最新文档
- 2026中国智能互联汽车车载芯片系统测试技术调研及车规级要求与检测标准报告
- 2026中国多频GNSS定位芯片在无人机导航中的抗干扰技术与高动态性能评估
- 2026中国医疗健康生物制药行业市场供需变化及投资布局发展策略研究报告
- 2026中国医药保健品市场消费行为与销售策略分析报告
- 2026中国艺术品投资服务行业市场现状供需分析及投资评估规划分析研究报告
- 2026中国水利工程建筑行业市场现状供需分析及发展规划评估研究报告
- 2026人工智能产业发展趋势技术应用场景与投资发展全面分析报告
- 2022 架空输电线路螺旋锚基础设计规范(条文版)
- 2026坍塌事故面试题及答案大全
- 2026提高应急能力面试题及答案
- 2026年陕西高职单招试题完整
- 2026年甘肃金麟锂电新材料有限公司招聘78人笔试参考题库及答案详解
- 2026福建福州市城市排水有限公司招聘6人笔试参考题库及答案详解
- 2026-2027学年安徽省高三六校第一次联考数学试卷(含答案解析)
- 中铝乾星(成都)科技有限责任公司招聘笔试题库2026
- 2026年中级经济法担保法律制度专项题库(含答案及解析)
- 2.2站稳人民立场( 教学设计) 统编版道德与法治 九年级上传(新)
- 住院患者跌倒风险动态评估与预防指南(2026年版)
- 2024 电动汽车用驱动电机系统
- 嘉兴南湖区招聘社区工作者笔试真题2025
- 2026年消防文职电脑操作测试题及答案
评论
0/150
提交评论