用大数据失败案例的血泪教训来诉说8个不能犯的错误

近年来,大数据旋风以“迅雷不及掩耳之势”席卷全球,不仅是信息领域,经济、政治、社会等诸多领域都“磨刀霍霍”向大数据,准备在其中逐得一席之地。然而,很多公司在迈入大数据领域后遭遇“滑铁卢”。在此,本文盘点了一系列大数据失败项目,深究其原因,具有警示意义。

对数据过于相信

2008年,Google第一次开始预测流感就取得了很好的效果,比美国疾病预防控制中心提前两礼拜预测到了流感的爆发。但是,几年之后,Google的预测比实际情况(由防控中心根据全美就诊数据推算得出)高出了50%。媒体过于渲染了Google的成功,出于好奇目的而搜索相关关键词的人越来越多,从而导致了数据的扭曲。

低估大数据复杂程度

在美国有几个互联网金融公司专做中小企业贷款。但是中小企业贷款涉及的数据更复杂,而且中小企业涉及到整个行业非常特殊的一些数据,比如非标准的财务报表和不同行业、不同范式的合同,他们没有很专业的知识,是很难理解或者很难有时间把它准确挖掘出来。

当时大数据团队想用一个很完美的模型把所有的问题都解决掉,比如把市场和信贷的解决方案全部用一个模型来解决,但因为数据的复杂程度,最后证明这种方法是失败的,而且90%的时间都在做数据清理。这就说明,想通过大数据技术一下子解决所有的问题是很难成功的,而是要用抽丝剥茧、循序渐进的方式。

管理层的惰性

某家旅游公司系统通过web日志数据的挖掘来提升客户洞察。结果证明,用户在浏览网站之后,随后的消费行为模式与管理层所认为的不一致。当团队汇报此事时,管理层认为不值一提。但是,该团队并没有放弃,并通过严密的A/B测试,回击了管理层的轻视。

这个案例的最终结果,不是每个CIO都能期盼的。但是,有一点是可以确定的:做好和管理层打交道的准备,让他们充分理解大数据是什么以及相应的价值。

应用场景选择错误

一家保险公司想了解日常习惯和购买生命保险意愿之间的关联性。由于随后觉得习惯太过于宽泛,该公司将调查范畴限定到是否吸烟上。但是,工作仍然没有实质进展。不到半年,他们就终止了整个项目,因为一直未能发现任何有价值的信息。

这个项目的失败是由于问题的复杂性。在抽烟与否之间,该公司没有注意到还有大片灰色地带:很多人是先抽烟而后又戒烟了。在将问题简单化动机的驱动下,这个部分被忽略了。

问题梳理不够全面

一家全球性公司的大数据团队发现了很多深刻的洞察,并且计划通过云让全公司共享。结果这个团队低估了效率方面的损耗,由于网络拥塞的问题,无法满足全球各个分支顺畅提交数据运行分析的需求。

该公司应该仔细思考下如何支撑大数据项目,梳理所需的技能并协调各IT分支的力量进行支持。由于网络、安全或基础设施的问题,已经有太多的大数据项目栽了跟头。

缺乏大数据分析技能

一家零售公司的首席执行官不认同亚马逊规模化、扁平化的服务模式,因此让CIO构建一个客户推荐引擎。项目最初的规划是半年为期,但是团队很快认识到诸如协同过滤(collaborative filtering)之类的概念无法实现。为此,一个团队成员提出做一个“假的推荐引擎”,把床单作为唯一的推荐产品。这个假引擎的工作逻辑是:买搅拌机的人会买床单,买野营书籍的人会买床单,买书的人会买床单。就是如此,床单是唯一的、默认的推荐品。

尽管可笑,这个主意其实并不坏,默认的推荐也能给企业带来销售上的提升。但是,由于大数据相关技能的缺失,真正意义上的引擎未能实现。

提出了错误的问题

一家全球领先的汽车制造商决定开展一个情感分析项目,为期6个月,耗资1千万美元。项目结束之后,该厂商将结果分享给经销商并试图改变销售模式。然后,所得出的结果最终被证明是错误的。项目团队没有花足够的时间去了解经销商所面临的问题或业务建议,从而导致相关的分析毫无价值。

应用了错误的模型。某银行为判断电信行业的客户流失情况,从电信业聘请了一位专家,后者也很快构建了评估用户是否即将流失的模型。当时已进入评测验证的最后阶段,模型很快就将上线,而银行也开始准备给那些被认为即将流失的客户发出信件加以挽留。

但是,为了保险起见,一位内部专家被要求对模型进行评估。这位银行业专家很快发现了令人惊奇的事情:不错,那些客户的确即将流失,但并不是因为对银行的服务不满意。他们之所以转移财产(有时是悄无声息的),是因为感情问题——正在为离婚做准备。

可见,了解模型的适用性、数据抽象的级别以及模型中隐含的细微差别,这些都是非常具有挑战性的。

管理层阻力

尽管数据当中包含大量重要信息,但Fortune Knowledge公司发现有62%的企业领导者仍然倾向于相信自己的直觉,更有61%的受访者认为领导者的实际洞察力在决策过程中拥有高于数据分析结论的优先参考价值。

选择错误的使用方法

企业往往会犯下两种错误,要么构建起一套过分激进、自己根本无法驾驭的大数据项目,要么尝试利用传统数据技术处理大数据问题。无论是哪种情况,都很有可能导致项目陷入困境。

提出错误的问题

数据科学非常复杂,其中包含专业知识门类(需要深入了解银行、零售或者其它行业的实际业务状况);数学与统计学经验以及编程技能等等。很多企业所雇用的数据科学家只了解数学与编程方面的知识,却欠缺最重要的技能组成部分——对相关行业的了解,因此最好能从企业内部出发寻找数据科学家。

缺乏必要的技能组合

这项理由与“提出错误的问题”紧密相关。很多大数据项目之所以陷入困境甚至最终失败,正是因为不具备必要的相关技能。通常负责此类项目的都是IT技术人员——而他们往往无法向数据提出足以指导决策的正确问题。

与企业战略存在冲突

要让大数据项目获得成功,大家必须摆脱将其作为单一“项目”的思路、真正把它当成企业使用数据的核心方式。问题在于,其它部门的价值或者战略目标有可能在优先级方面高于大数据,这种冲突往往会令我们有力无处使。

大数据孤岛

大数据供应商总爱谈论“数据湖”或者“数据中枢”,但事实上很多企业建立起来的只能算是“数据水坑儿”,各个水坑儿之间存在着明显的边界——例如市场营销数据水坑儿与制造数据水坑儿等等。需要强调的是,只有尽量缓和不同部门之间的隔阂并将各方的数据流汇总起来,大数据才能真正发挥自身价值。

在大数据技术之外遇到了其它意外状况。数据分析仅仅是大数据项目当中的组成部分之一,访问并处理数据的能力同样重要。除此之外,常常被忽略的因素还有网络传输能力限制与人员培训等等。

回避问题

有时候我们可以肯定或者怀疑数据会迫使自身做出一些原本希望尽量避免的运营举措,例如制药行业之所以如此排斥情感分析机制、是因为他们不希望将不良副作用报告给美国食品药品管理局并承担随之而来的法律责任。

在这份理由清单中,大家可能已经发现了一个共同的主题:无论我们如何高度关注数据本身,都会有人为因素介入进来。即使我们努力希望获取对数据的全面控制权,大数据处理流程最终还是由人来打理的,其中包括众多初始决策——例如选择哪些数据进行收集与分析、向分析结论提出哪些问题等等。

为防止大数据项目遭遇失败,引入迭代机制是非常必要的。使用灵活而开放的数据基础设施,保证其允许企业员工不断调整实际方案、直到他们的努力获得理想的回馈,最终以迭代为武器顺利迈向大数据有效使用的胜利彼岸。

本文作者:佚名

来源:51CTO

时间: 2024-10-24 16:18:56

用大数据失败案例的血泪教训来诉说8个不能犯的错误的相关文章

大数据失败案例之七宗罪

要实现大数据分析项目的最佳实践并非易事.正因如此,Gartner研究总监Svetlana Sicular题为"大数据7大失败案例"的报告吸引了思科工程师Karen Liu的注意. "我们正处于开始阶段,想了解下其他人正在做什么,有哪些成功案例."Liu说:"而所有的失败案例,也是我们必须学习并加以警惕的." 很多人有着和Liu一样的想法.Family Dollar Stores Inc.(美国知名折扣零售商,总部位于北卡罗来纳的夏洛特,最近刚被另

大数据失败案例提醒:8个不能犯的错误

近年来,大数据旋风以"迅雷不及掩耳之势"席卷全球,不仅是信息领域,经济.政治.社会等诸多领域都"磨刀霍霍"向大数据,准备在其中逐得一席之地.然而,很多公司在迈入大数据领域后遭遇"滑铁卢".在此,本文盘点了一系列大数据失败项目,深究其原因,具有警示意义. 对数据过于相信 2008年,Google第一次开始预测流感就取得了很好的效果,比美国疾病预防控制中心提前两礼拜预测到了流感的爆发.但是,几年之后,Google的预测比实际情况(由防控中心根据全美就

农夫山泉用大数据卖矿泉水:5大案例解析

*利用大数据后,http://www.aliyun.com/zixun/aggregation/14138.html">农夫山泉会发生管理变革吗?YES *中国能制作出类<纸牌屋>的电视局吗?NO *大数据可以给阿迪达斯带来利润吗?YES *网易数据工程师可以当"媒婆"?YES *中国政府未来会开放数据吗?YES *正在到来的数据革命改变政府.商业和我们的生活- 就在制作这期"大数据专题"时,编辑部发生热烈讨论:什么是大数据?编辑记者们旁

聊聊从设计实战失败案例中学到的经验教训

  今天这篇文章不长,但非常值得初入设计的同学阅读,如果经常抱怨甲方不懂设计,每次改稿都愤慨不已,那就更有必要学习了,来自一个设计师的失败案例总结,用亲历经验告诉你,为什么优秀的设计师很少提视觉,而都把解决问题挂嘴边. 修习手艺是一门磨性子的活儿,设计也不例外.历经提案怎么改都通不过的愤慨,不如心平气和来看待它,会发现这其实是不可多得的学习机会.再恶俗的反馈,深究其中,也会有所得.设计不是纯艺术,自High不该是我们的追求.设计是一种解决问题的方式,所不同的是,它用眼睛来说话. 虽然"解决方案&

如何用大数据和开放平台创新

在一个大部分数据可以实时获取而且存储没有限制的世界里,金融机构该如何竞争?更多的数据和更多的数据归档服务不一定能帮助金融机构更好地服务客户,除非可以以一种能为顾客带来便利的独特方式使用这些数据.你的银行现在所处的位置有利于他们想出新的而且具有创造性的办法使用数据吗?如果不是,你或许得考虑与某个能够为你的机构和客户拿出新的数据形式,并让它们变得更有价值而且有意义的人展开合作.在本章,我们将讨论金融机构如何才能最大限度地利用数据,以及为什么数据和开放平台常常携手出现.我们将谈谈贝宝在开放其平台时候的

用大数据“催债”,这家创业公司找到了一个P2P市场痛点

鑫利源等一批互联网金融平台暴露了金融P2P领域的债务违约问题,背后的原因涉及投资项目失败或者贷款人欠债不还.甚至贷款人失踪等问题. 公开数据显示,在债务市场存在30%的银行.25%的P2P全口径不良失联客户,9%的银行核销失联客户,10%的不良资产多手单失联客户. 这不仅让投资人的钱打了水漂,P2P等金融平台也承担了大量债务违约风险.在火爆的P2P互联网金融市场,追债服务成了刚需. 而利用"大数据"手段提供追债服务,也是一个创新方式.北京共鸣众信科技有限公司投资成立的快催收,就是专门解

败局启示录 中国ERP著名失败案例分析

中国已经有很多企业开始实施ERP了,有成功的案例,但是更多是失败的案例,这些企业实施ERP失败的教训在哪里呢?还是ERP真的不适合中国的国情吗? 尽管ERP的高失败率已经成为不争的事实,诸如成功概率为0说.80亿投资水漂说.三分之一能用说等流行说法相信大家并不陌生,但是令人不解的是,至今尚无权威机构有关这方面的统计数字.即使在一些文章中看到类似的数据,也是语焉不详或数出无名,缺乏科学根据.虽然大家都在谈论失败面如何之广,但是有关失败的案例却隐而不现,很少有报刊报道.相比而言,http://www

血泪教训:创业失败20个原因缺乏需求和VC不合

CB Insights公司深入剖析了101篇由公司创始人撰写的失败剖析文章,探寻了他们心目中自己公司失败的根本原因.当创业公司的创始人关掉公司时,他们往往会写上一篇文章,对圈中人交代一下自己走过的弯路,这种文章就叫失败剖析.据估计,每10家创业公司中就有 9家会失败,这也是为什么失败剖析文章层出不穷,成为硅谷的陈词滥调.这类文章有些写得坦诚.勇敢.发人深思,还有一些就只知道推卸责任,或是根本不认为自己有什么应该检讨之处.当创业家发表失败剖析时,他们往往最青睐由Twitter公司联合创始人伊万•威

揭秘一个城市如何“智慧交通”:高德地图用大数据“治堵”,圈地逾百城

互联网正在改变城市交通,而高德地图欲打造城市交通大脑.今天,在北京"互联网+城市交通管理创新"论坛上,高德地图宣布已经与国内100逾城市战略合作,共建智慧交通.高德地图交通大数据平台已经能够支持全国362个城市,进行交通研判和分析,帮助实现交通智能化管理. 城市交通的互联网+进化  之所以说互联网让城市交通迎来巨变,阿里文娱集团董事长兼CEO.阿里影业集团董事长俞永福指出原因有二:   阿里文娱集团董事长兼CEO.阿里影业集团董事长俞永福 1.2017年,全国主要城市"互联网