举谬《大数据时代》:了解大数据不要盲目跟风

  近年来,大数据在我国得到一致重视,各行各业兴起了一股重视大数据、应用大数据的热潮。这种全民迅速接受新生事物的现象,反映了中国经过改革开放,现代化意识深入人心的可喜状况,令人鼓舞。但是,由于">大数据技术发展迅速,一些囫囵吞枣的浅知误见也随之流传,如不及时纠正,将造成对大数据先入为主的误区,影响经济社会发展。当前国内十分流行的《大数据时代》(维克托·迈尔-舍恩伯格等著,178.html">浙江人民出版社,2013年,以下简称《时代》)中提出了三个存在严重谬误的观点,特此指出,以期引起注意。

  “不是因果关系,而是相互关系”?

  《时代》一书的主要观点之一是,大数据时代“不是因果关系,而是相互关系”。其实,早在18世纪,英国怀疑论者休谟就指出,“不但我们的理性不能帮助我们发现原因和结果的最终联系,而且经验给我们指出它们的恒常结合以后,我们也不能凭自己的理性使自己相信,我们为什么把那种经验扩大到我们所曾观察过那些特殊事物以外。我们只是假设,却永远不能证明,我们所经验过的那些事物必然类似于我们所未曾发现的那些对象。”

  《时代》一书将这一早已提出几个世纪的观点,作为大数据时代的新概念,不仅陈旧,而且错误。因为,简单地说大数据时代“不是因果关系,而是相互关系”,说明作者不了解因果关系本身也是一种相互关系,即原因与结果前后相继的相互关系,因此将因果关系归结为相互关系并不比因果关系本身更有内涵,实际上,这甚至是一种同义反复。

  正确的观点应该明确因果关系是一种什么样的相互关系,而这一点经过20世纪自然科学和数理哲学的研究已经有了更深刻的认识。计算机的发明,使得人们开始从计算机语言表达、传递信息的角度来理解知识的起点。大数据时代的到来,使得人们豁然开朗。

  经济学者李德伟教授在《时代》中译本发表之前,就已提出大数据时代不再强调因果关系,也不是简单地将因果关系归为相互关系,而是精确地指出客观事物运动序列之间存在同构关系,特别是人类认识与外部客观事物之间存在对应的、同构的关系,信息的表达、传输和存储就是一种同构关系,也就是说,外部客观事物运动与人的主观认识都是客观世界的事物现象,是协调性的、一一对应的相互关系,主观认识映像只是承载、传递外部客观事物现象的一种符号系统。无论是从人自身悟出来,还是从外部经验事物抽象出来,都是同构的、对应的关系。

  “不是随机样本,而是全体数据”?

  《时代》一书认为大数据时代“不是随机样本,而是全体数据”,认识事物不再是从随机抽取的部分样本,而是从全部数据出发。这种说法忽视了全部与部分的辩证关系。人类在有限的时间内不可能穷尽事物的全部,绝对真理只能在人类前后相继的、永远不会停止的认识过程中实现。任何事物的发展总是有过去、现在和未来,现在的是现在,未来的尚未出现,全部案例不可能在有限时间内达到,认识也永远不会完结。未来的与过去和现在相比还是无穷大的。正因为如此,波普尔才提出,“全称命题不可证实,只能证伪。”

  实际上,过去的小数据时代的抽样调查方法与现在的大数据方法相比,只能说是大数据时代可以用更为精确的、全面的数据,以包含更大因素的仿真模型来追踪、分析模拟现实,取得比过去更为精确的认识结果。尽管如此,与全体相比,已经认识的永远是少数,误差、错误还是不能完全消除。例如,通过人口普查分析现在中国人具有什么特点。不要说全部认识现有13亿人口的全部属性不可能(因为事物属性有无穷层次),即使说能够完全认识现有13亿人口全部属性,也不意味着过去、未来的中国人,也能够全部认识。未来的中国人与已经认识的现有中国人相比还是无穷大。因此,大数据与小数据相比只是以巨量的、全面的、即时的数据来认识事物,但是要掌握全体数据在有限时间内总是不可能的。

  “不是精确性,而是混杂性”?

  《时代》作者说大数据时代“不是精确性,而是混杂性”,意指小数据时代是讲究精确性,大数据时代因为掌握了大量数据可以不再拘泥于精确性,而是依靠大数据比较模糊地行动。这显然是错误的。因为在小数据时代能够掌握精确的小数据,但是大多数数据却被遗漏、舍弃,认识的结果就无法实现精确、全面,真理和错误的边界也不是很清楚,这时的认识是模糊的、有偏差的。在大数据时代,因为掌握了更为全面的数据,可以在更大的范围认识事物,因此,能够更为准确、量化,以至于对一些中间模糊区域也可以得到更为准确的认识,其精确度和模糊度、误差本身都更为精确量化。例如,在计算机信息系统中,发布更多的信息,通过反复比对、纠错机制,降低噪音,到达精确度。这一点在人类的认识活动中本来就是这样做的,“耳听为虚”就以“眼见为实”来纠错,小数据一两个来回不可能正确,反复多次大数据比对,就能达到越来越高的精确度,误差率就越来越小。

  中国人口世界第一,信息产业市场最大,最有机会发展信息化、大数据和智慧化产业。但中国目前在对大数据的认识上有一种盲目跟外国之风的倾向。对于国外大数据理论,我们应以批判的眼光保持清醒的认识。

您还可以浏览:

  1.大数据时代哪些数据分析不了

  2.大数据时代需要想象力

  3.《大数据时代》读后体会

时间: 2024-10-22 14:08:08

举谬《大数据时代》:了解大数据不要盲目跟风的相关文章

大数据时代说来就来 数据垃圾变黄金

大数据时代是指以大数据为驱动,影响生产率增长和消费者盈余模式的一个新的时代.大数据是高容量,高速度和高品质的信息资产,需要新的处理形式,其难以采用常规工具进行采集和处理,大数据时代里,常利用软件工具对海量数据进行挖掘和运用,借此帮助进行决策.洞察发现和流程优化. 大数据时代的迟到 一般来讲,大数据的概念提出可以追溯到上世纪90年代,大数据一词在当时就已经开始流行.而知名的咨询公司麦肯锡在2011年提出"数据,已经渗透到当今每一个行业和业务职能领域,成为重要的生产因素"正式代表着大数据时

舍恩伯格论大数据时代:大数据能做什么

文章讲的是舍恩伯格论大数据时代:大数据能做什么,7月28日,<大数据时代:生活.工作与思维的大变革>作者.牛津大学教授维克托·迈尔-舍恩伯格,参加了在青岛举行的2013年海尔商业模式创新全球论坛.论坛上,舍恩伯格纵论数据的价值.如何开发运用数据的价值,以及未来大数据时代将带来的经济模式变革. 要学会善用更多的数据 在过去的十多年中,互联网的广泛应用,极大降低了交易成本.但在舍恩伯格看来,另外一场革命即将到来,就是大数据时代带来的革命. 他举例说,一位华盛顿大学计算机系教授创办的大数据企业,到所

大数据时代,小数据中心

文章讲的是大数据时代,小数据中心,中国(上海)国际数据中心技术设备展览会在上海隆重开幕.紧跟德国工业4.0的新趋势,威图(Rittal)携绿色.节能.可靠的数据中心系统解决方案登陆本次展会.在变革的大数据时代,威图(Rittal)将引领数据中心行业健康稳步发展. 展会现场,威图针对模拟的微模块.通道封闭系统,进行了实时监测,参观者可以通过液晶屏,直接了解数据中心内部各项指标信息.威图(Rittal)的微模块,它可根据客户需求在工厂进行预制,并可灵活拆卸,快速组装.威图(Rittal)的LCP机柜

同有科技分享大数据时代新型大数据处理中心的特征

摘要: 日前,北京同有科技举办了主题为"数据改变未来,应用定义存储"的2013年渠道峰会.来自全国近百家重点核心合作伙伴参与了会议,与同有科技一起探讨了如何帮助中高端存储用户构 日前,北京同有科技举办了主题为"数据改变未来,应用定义存储"的2013年渠道峰会.来自全国近百家重点核心合作伙伴参与了会议,与同有科技一起探讨了如何帮助中高端存储用户构建数据中心,帮助他们迅速适应大数据时代的应用需求. 大数据时代,具备大数据特征的应用越来越多,对数据中心的需求有了革命性的变

大数据时代下的“数据失控”危机

&http://www.aliyun.com/zixun/aggregation/37954.html">nbsp; 麻省理工学院的阿莱克斯·彭特兰教授说"赤裸裸地站在数字聚光灯下接受审查不是人们应该得到的待遇",这句话听起来既包含着对改善人类当前数字化生活尴尬处境的坚决,又透露出对人们失去个人数据控制力的无奈.频繁发生的数据泄漏事件已经宣告了"数据失控"时代的到来. 在过去差不多十几年的时间里,我们毫无保留地把个人信息交给了互联网,这些信息

大数据时代 你的数据属于谁?

在这个所谓的DT(数据科技)时代,数据的价值正在为人所知,由此而来的个人信息泄露事件也层出不穷.然而,当人们将矛头指向黑客入侵系统漏洞.撞库拖库等,却忽略了掌握数据源的互联网企业. 记者调查:诸多网站默认可以转让你的信息个人数据至今无法确权 在这个所谓的DT(数据科技)时代,数据的价值正在为人所知,由此而来的个人信息泄露事件也层出不穷.然而,当人们将矛头指向黑客入侵系统漏洞.撞库拖库等,却忽略了掌握数据源的互联网企业. <IT时报>记者在调查中发现,数据价值虽已传递到产业链的各个环节,但数据交

信息过载的大数据时代,大数据推荐系统如何搭建,趋势何方

同比增长随着大数据时代的来临,网络中的信息量呈现指数式增长,随之带来了信息过载问题.推荐系统是解决信息过载最有效的方式之一,大数据推荐系统已经逐渐成为信息领域的研究热点.介绍了推荐系统的产生及其在大数据时代的发展现状.推荐系统的领域需求和系统架构.大数据环境下推荐系统的挑战及其关键技术.开源的大数据推荐软件.大数据推荐系统研究面临的问题,最后探讨了大数据推荐系统的未来发展趋势. 1 推荐系统与网络大数据 随着科技与信息技术的迅猛发展,社会进入了一个全新的高度信息化的时代,互联网无处不在,影响了人

大数据时代:挖掘飞行数据价值

大数据时代已经来临. 航空公司也同样拥有大量的数据,仅飞行数据就可以包含QAR(快速存取记录器)数据.运行签派数据和飞行计划数据等,数据规模巨大.然而,掌握这些庞大的数据信息只是基础,将这些有含义的数据进行专业化处理,挖掘其价值才能达到帮助航空公司经营决策的目的. 从2011年开始,山东航空公司尝试综合集成QAR.运行签派.飞行计划等飞行数据,搭建飞行数据综合利用系统这一综合平台.2013年,该系统建设完成.山航利用该平台监控临时航线的使用情况,合理安排临时航线.2013年,山航全年缩短飞行距离

大数据时代的“小数据”

如今,CIO们都已经接受了"大数据"的概念,另一个概念也逐渐受到关注:小数据. 这两者看似是相对立的两端,但是这不完全正确.小数据往往指数据量;而大数据当然也包含了数据量,但是也包含了多样性,时效性,特定的技术或者其他概念. Kirk Borne,是美国乔治梅森大学的天体物理学和计算机科学的教授, 他认为这两者的区别是很重要的.Borne有关大数据的课程专注于大数据的属性和先进的分析技术, 而这些也几乎总是可以应用于小数据.但是后者却可以使学生进行实验,磨练他们在数据分析上的技能.而大

“后大数据”时代,给数据加上智能

今年是人工智能大火之年,不仅有3月份AlphaGo 与李世石的人机大战让普罗大众知道了人工智能的巨大进步,更有各种有关自动驾驶.无人汽车的新闻不断给人工智能"添柴加火".人工智能的大火似乎让大数据有些相形见绌.不过,在大数据专业人士TalkingData CEO崔晓波看来,人工智能这一轮"行情"也可以纳入大数据的发展轨道,标志着大数据进入"后大数据时代",也称智能数据时代--这是TalkingData主办的"T11 2016暨Talki