你不得不知道的6个用好大数据的秘诀

这篇文章里,有三位来自不同公司的大数据运营人员各自分享了他们运用大数据的经验。这三位是来自维亚康姆(Viacom)的Luzzi、Globys公司的Olly Downs以及知名市场顾问公司Dunnhumby的CEO Andy Hill。

秘诀一:目标要明确

就算一个公司拥有再多的数据,也不能代表它就一定会获得商业上的成功。只有真正懂得如何利用大数据,了解到公司利用大数据可以达到什么目标,公司最终才有可能真正成功。在公司在发展过程中往往也会面临诸多选择,也只有目标设定明确了,才能够缩小选择范围聚焦精力去发展。企业应时刻保持头脑清醒,朝着自己定好的目标前进,才有助于公司进行持续长久的良好运作。

不过,Luzzi也表示,有时候,利用太复杂先进的数据分析工具往往也会带来很多问题,不过如果我们能够通过分析大量的数据来得到最终的结果,那就不用怀疑了,你就干吧,至少方向肯定是对的。

秘诀二:要区分清楚“森林”和“树”

现在,企业可以做到一些他们以往没有能力做到的事。对于很多公司来说,可供分析的数据更多,可以用来分析数据的工具和方法也比以前更先进方便。公司已经完全有能力去分析和处理他们收集到的大量数据,这对于企业来说或许是件好事,然而,有时候这些数据也会过于分散。

Globys公司的Olly Down表示说,现在,很多公司都倾向于收集精度较高的数据,因为获得的数据越精确,就越有利于分析受众群体,也更有利于公司进行相关战略和产品的调整。不过,公司往往需要花费大量的时间去处理大量的数据,结果却有可能不尽如人意,所以,在进行数据分析处理时,有时候没有必要执着于某一棵“树”长成什么样子,而应该注重这片“森林”,要懂得舍小取大。

秘诀三:做好团队的协调

在大数据的世界里,最有价值和作用的数据往往十分稀少。要想找到真正有价值的数据,就如同大海捞针一样困难。所以,为了找到这些有价值的数据,企业内部应齐心协力通力合作,要经常保持有效的沟通和协作。

例如,为了能更好地利用数据来分析公司的实际运营情况,数据专家们应该了解公司决策者为公司制定的战略目标。反过来也一样,公司决策者也应该知道,公司的数据团队得出的分析结果,最终能给公司带来什么收益。

Luzzi 表示,以大数据作为工具,他可以建立模型来帮助公司做出商业决策。由于公司决策者对公司整体运行情况及所处商业环境更加了解,当决策者看到分析结果时,肯定能看到一些他看不到的地方。但同时,决策者们也不会知道他是用什么方法得出这些数据和结果的。

Olly Downs也说,公司的数据团队和各部门以及管理层应保持良好的沟通交流,这样公司才能良好高效的运行,有效的协调配合需要通过有效的沟通交流来实现。有一个商业智能团队为预测公司的客户流失率建立了一个模型,由于大家缺少有效的沟通,操作团队认为这个模型“很有趣”,但是公司却认为这个模型没有任何意义。

“如果你的公司雇佣了一个数据研究小组,他们宣称自己建立了一个有效的模型,可是公司别的相关部门却认为这个模型没有效果,原因便在于二者之间缺乏沟通。”Downs表示。

秘诀四:用机器代替人工

机器学习指计算机模拟或实现人类的学习行为,以获取新的知识或技能,从而对自身功能进行改进。机器学习相比人工学习,速度更快,学习规模也更大,一个公司能通过机器学习较快地发现新的问题。

比如,为了研究特定消费者的消费行为模式,企业可以研究用什么样的方式对单个消费者进行研究分析,依据不同的消费者选择不同的模型,进而对消费者行为进行追踪研究。公司认为,在单个消费者身上所需的分析时间是10分钟,按照这个速度,公司共有260万消费者需要调查追踪,需要416000个分析员,每天工作10小时,每天观察单个消费者8次,才能得出结果。显然,如果真通过人工分析,那就需要花费太多的时间和精力了。

所以,Downs认为,企业如果有大量的数据需要进行分析处理,最好的办法就是让机器代替人工来做,机器学习的速度很快,能在短时间内同时分析大量的数据,这样一来,所需的分析时间就会大大缩短。与人工分析相比,成本也会大大降低。

秘诀五:要谨慎对待数据

有时,企业是没有能力去获取数据的,也就没法用数据去解决问题。就算公司获得了一些数据,他们往往也不清楚这些数据最终能否解决他们的问题。

在这一点上,维亚康姆集团的Luzzi的建议是,一个数据是否有效,是否能帮助公司解决问题,最好询问数据小组的意见。

Dunnhumby公司会对消费者数据进行统计和分析,这样一来公司便可以了解到哪些数据是有用的,以及这些数据有多大价值。如果公司能收集到有价值的数据,公司实际经营中遇到的相关问题就能得到有效解决。知名市场顾问公司Dunnhumby的 CEO Andy Hill表示,企业不仅应该了解收集到的数据到底能解决哪些问题,更应该知道,哪些问题还不能通过这些数据得到解决。如果还有一些问题解决不了,公司便需要继续收集其他维度的数据来补充。

有时候,重要的数据可能会被忽略。比如,当Downs为他的前东家搭建交通情况模型时,大家普遍认为天气是预测交通状况的最重要因素。后来研究结果却显示,最影响那个地区交通状况的是当地学校的放学时间。当学生们放学时,堵车情况尤为严重。

Downs说,从一开始的假设来看,我们并没有预见到会得出这样的结论,所以,应谨慎认真对待数据,数据会真实客观地告诉你想要的答案。有时,数据能告诉你的会让你大吃一惊。

秘诀六:要避免得出错误的结果

由于人为主观因素和不相关数据的干扰,有时候得出的结论往往是错误的。

“不要让不相干的数据影响到整个结果,有相当一部分的数据并不重要,这些不相关的‘树’往往并不能代表整个‘森林’。”Luzzi说,“如果使用了错误的数据,得出的结论往往也是错的。”

数据选择上的错误会影响人们解决问题的过程,也会影响人们如何看待这些数据和结果。错误的数据选择可能影响到公司做出相关决策。

Dunnhumby 公司的CEO Andy Hill表示:“为了消除数据上的误差,你需要准确找到特定的目标人群,这些人的行为往往可以准确地回答你需要解决的问题。

本文作者:佚名

来源:51CTO

时间: 2024-09-04 21:04:14

你不得不知道的6个用好大数据的秘诀的相关文章

为何牵手FICO?你所不知道的亿美软通大数据

提到FICO,在征信圈和大数据领域可谓大名鼎鼎,如同汽车界的通用集团,IT领域的IBM,通信圈的华为.爱立信,其每一步发展都在影响着美国征信体系的建设与完善,目前FICO个人消费信用评分体系已经成为美国使用最广泛的征信模型. 近日,一条新闻<亿美软通与FICO达成技术合作 深挖大数据价值潜能>在行业内引起了不小的震动,FICO作为行业老大的地位,为何选择亿美软通?技术合作又是什么?其实看透各中原因,也就不足为怪. 同样的"小目标" FICO信用分在经过三十年的发展,在美国已

关于谷歌PR你可能不知道的一些事情

PR一直以来都被很多站长当成是唯一衡量网站权重的标准,我们在交换友情链接,在评估竞争对手网站的价值时总理不开它,这反而让很多站长只过分注重于PR值还忽略了其他方方面面的优化因素.那么谷歌PR的哪些事情可能是你所不知道的呢? 1. PR只能评估网页外链数量和网页外链质量,并不能指代网页权重.换而言之,PR只与外链数量和质量相关,与其他因素无关. 2. 一个PR4.只拥有5个出站链接的网页要比一个PR8,但拥有100个出站链接的网页要有价值得多. 3. 从PR0到PR1相对容易些,从PR1到PR3会

关于Java性能监控您不知道的5件事,第2部分:利用JDK内置分析器进行Java进程

关于Java性能监控您不知道的5件事,第2部分:利用JDK内置分析器进行Java进程监控 全功能内置分析器,如 JConsole 和 VisualVM 的成本有时比它们的性能费用还要高 - 尤其是在生产软件上运行的系统中.因此,在聚焦 Java 性能监控的第 2 篇文章中,我将介绍 5 个命令行分析工具,使开发人员仅关注运行的 Java 进程的一个方面. JDK 包括很多命令行实用程序,可以用于监控和管理 Java 应用程序性能.虽然大多数这类应用程序都被标注为 "实验型",在技术上不

关于Java Database Connectivity您不知道的5件事:提升您和JDBC API的关系

关于Java Database Connectivity您不知道的5件事:提升您和JDBC API的关系 目前,许多开发人员把 Java Database Connectivity (JDBC) API 当作一种数据访问平台,比如 Hibernate 或 SpringMany.然而 JDBC 在数据库连接中不仅仅充当后台角色.对于 JDBC,您了解的越多,您的 RDBMS 交互效率就越高. 在本期 5 件事 系列 中,我将向您介绍几种 JDBC 2.0 到 JDBC 4.0 中新引入的功能.设计

7大你可能不知道的Chrome使用技巧

微软IE一手遮天的时代已经一去不复返了,而在当下浏览器的"战国割据"中,近几年异军突起的 Google Chromium/Chrome 以及基于其衍生出的浏览器(如360极速.搜狗.枫树--)占据用户桌面的份额越来越大,因此极客公园整理了一些你可能不知道的使用技巧,可以让你更加快速熟练的使用 Chrome,让事情变得更简单,提高生活.工作.学习效率. 一. 快速关闭标签页 相信大多数人依旧是用鼠标直接点击那个关闭按钮来进行标签关闭的,你或许知道 Chrome 专门对标签关闭优化过,每次

你可能不知道的Shell(有趣的知识)

Shell也叫做命令行界面,它是*nix操作系统下用户和计算机的交互界面.Shell这个词是指操作系统中提供访问内核服务的程序. 这篇文章向大家介绍Shell一些非广为人知.但却实用有趣的知识,权当品尝shell主食后的甜点吧. 科普 先科普几个你可能不知道的事实: Shell几乎是和Unix操作系统一起诞生,第一个Unix Shell是肯·汤普逊(Ken Thompson)以Multics上的Shell为模范在1971年改写而成,并命名Thompson sh.即便是后来流行的bash(shel

你可能不知道的Photoshop图层操作技巧

  Photoshop的图层面板大家都很熟悉了,还能有什么不知道的呢?!本文为大家介绍一些很少被人注意到但却很有用的图层编辑和管理技巧.这些技巧包括填充不透明度.多蒙版和智能对象.调整层.快捷键.高级混合选项.图层面板选项等等. 1. 填充不透明度 填充不透明度可以减少一个图层内容的不透明度,而不能减少图层样式的可见度.因此,诸如渐变叠加等图层样式最好设置成叠加模式来保持图层的穿透效果. 2. 图层组快捷键 当你的文件中有很多图层组并且嵌套时,你可以考虑使用下面几个快捷键来提高工作效率: · 按

你所不知道的关于网管的危险做法

  你所不知道的关于网管的危险做法 网络管理员是指向社会公众开放的营业性上网服务提供场所里的管理员.Jeff Dray 最近经过对IT行业的深入调查研究,通过总结和分析针对IT行业列出了一份类别名单.在这里,他定义了七类最不安全的网络管理员.如果你是一名网络管理员,并且已经意识到工作中还存在着不足,看看你属于名单中的哪一类? 大多数网络管理员对工作游刃有余,并且可以在一个具有高度挑战和技术难度的任务中,使工作顺利进行.然而,有时他们中的某些人会变得很难缠,并会阻碍事情的顺利进行.所以,我定义了一

win7中不知道的搜搜功能超高级技巧

很多时候我们在使用电脑的时候,都需要用到电脑的搜搜功能.但是有些时候比如搜搜QQ出来的内容非常之多,我们根本不可能一个个去看,这时候我们就需要使用到一些高级的技巧,来方便我们快速找到我们想要的文件. 1 在xp系统中,我们习惯右键我的电脑,然后选择搜搜功能,进行搜搜.而在win7中我们大部分的情况下使用的都是直接在开始菜单里面输入我们想要的东西进行搜搜,比如QQ.搜搜结果如图:你会发现win7对于搜搜结果进行了详细的分类方便我们查找. 2 如果没有你想要的,你可以查看更多搜搜结果,这是你看到文件