大数据如何改善我们周围的生存环境

在正式讲环境大数据之前,我们来讲一个和身边有关的案例。大多数去过星巴克喝咖啡的人都会有这样一个疑惑,“为什么星巴克室内温度比室外温度低呢?”甚至有人开始抱怨说室内温度太低,但是这也不会带来什么改变。因为在冷的环境下,顾客肯定会倾向于买热咖啡,而且是大杯的热咖啡。像温度、水分、声音这些东西跟我们平时生活息息相关,包括购买意愿实际上跟我们周围环境都是直接相关的。

环境数据的特性

前段时间参加了100offer组织的大数据技术沙龙,参讲嘉宾都是来自知名互联网科技界的技术牛人,但是给我影响最深的还是佳格大数据CTO张弓讲的大数据在环境改善方面所做的一些努力,如何通过数据分析来确定一定范围内气候的变化,以及接下来大数据在环境技术方面还需要做那些完善。

张弓说,环境两个字解开了说就是环我之境,周围的环境才是我们所研究的数据核心。所谓环境大数据就是指气象、温度、湿度,包括道路图、建筑图、污染问题,也包括资源性的数据。这些数据有一个特点,具有时空场。

大家现在都讲大数据,大数据就是最核心的三维,人们通过IT技术获得更多的数据。大约15年前,我们就开始通过接触环境数据来做天气预报,因为这是一个处在前端、即时性要求非常高的预报,所以数据的模拟处理都是按照秒级来计算的。所以说数据量是非常大的,包括各种卫星图像所提供的点上数据、面上数据,但是主要以图像或图像流为主。在现在看来,那就是海量数据。

卫星影像到全球原油储量

这里再列举一张Skybox拍摄的储油罐的照片,从这一张照片上能获得哪些有价值的数据呢?当然是可以从中获悉储油海港的大小,运输量的大小。

这些数据都是从储油罐的阴影来计算的,通过太阳高度角和阴影长度来计算储油罐的油量,基本上利用这样的方法能将全球80%以上的原油储量计算出来,而且是完全不可阻止的。这就是黑科技的用途。

大数据就是技术型企业的根本,对数据的分析精度决定了数据的价值大小,张弓说他们以前分析数据的尺度非常粗糙。简单的说,对时间的衡量是以年或月做单位的,这种数据分析的商业价值就会比较低,更多作为策略性使用。

环境数据:大数据时代前的海量数据

现在的原始数据是非常大的,比如一张从卫星里发送出来的图片,是一种描述地面的时空数据,数据量非常大。另外一类是模型数据,对模型进行分析。因为时空是连续的,所以用于模型分析的方法相对较为复杂,例如从内蒙古刮过来的沙尘暴会到它的下风口北京,属于连续时空性动作,很难用数据来描述。十几年前基于数学算法,针对时空图像数据利用MPI+Fortran来处理海量数据,还创造出HDF和NetCDF这些类似于现在Spark或Hadoop的工具。

众所周知,数据最核心的部分就是具有极强的时空连续性,这里就涉及到数据获取和数据融合的问题,因为不同的数据源,不同的数据类型、不同的数据格式,导致每一个时空上面颗粒分辨率是不同的,如何把250米*250米的数据和一个30米*40米的数据进行比较,这里就涉及到比较复杂的时空尺度融合问题。从数据结构上考虑,如果时空数据本身是连续的,可能更便于计算,它的分析工具的内核也是基于Spark为主。

数据可视化就更复杂了,这里面最主要的一个可视化类型就是把数据变成图形来展现,而且让人们更容易的接受这些图片。

数据分析是针对图像数据化过程的核心内容,就相当于一个分析可视化的过程,从而获得我想要的数据,这是比较困难的。所以这里就用到了能够进行图像识别和模式识别的机器学习和深度学习的概念。比如说如何用不同的颜色把田地里不同作物表示出来,哪怕是作物的方向也要识别出来的话。这里就要分析纹理的朝向和密度。第一步先做深度学习,原始分辨率是半米乘半米,深度学习要有足够的层数,然后对图像进行处理,建立一些窗口,比如建立3乘3、5乘5、9乘9窗口,下图是用了208个方块做出来的深度神经网络结果,识别度超过人眼。这样做的结果就是能够很清晰的知道庄稼的长势如何,如何根据这些数据来安排接下来的土地利用情况,最大化土地利用率。

  雾霾预测

这里可以来谈谈之前在网上传播很广的雾霾预警图——佳格“霾图”。这是基于环境大数据,对大气污染进行实时监测预警的工具。“霾图”用地图的形式实时展现我国任一地区的大气污染数据,并预测未来五天的空气质量。其实时数据目前每小时更新一次,空间精度为五公里。用大数据直面雾霾这块“硬骨头”,不仅需要充分准确的数据源、优秀的数据处理,还需要合适的可视化能力。

对于采集到的大量数据,需要进行整合处理才能用来生成霾图。霾图的数据算法主要包含两个任务:

数据同化和实时展示任务。获得的卫星数据主要分两种,一种是时间分辨率高的数据,一种是空间分辨率高的数据。这需要把两种数据进行融合;同时卫星并不会直接给出PM2.5的测量数据,而是一类光学指标,其中包括大气气溶胶光学厚度(aerosol optical depth)。利用基于不同城市自主研发的算法将这个变量计算出准确的PM2.5浓度值,并在“霾图”上实时展示。

预测任务。目前国内空气质量预测主要有两种传统方法:第一种是根据大气物理化学(污染物的沉降,运输和扩散以及二次气溶胶反应)的经典算法跟污染物排放清单的集合对未来大气情况进行推测;第二种是基于数理统计模型方法。比如拿到过去十年的数据,通过对时间序列的季节性,趋势性进行分析来做预测,辅以人工判断。这两种方法主要使用的都是地面监测点提供的数据,并没有用到卫星数据。同时国内排放清单数据存在时效性弱的弊端,并且地面监测点分布不均且数据容易受到人为因素的影响。这样所得到的预测结果存在着极大的偏差和局限,准确度较低。

相比这两种传统方法,佳格“霾图”所开发的预测方法和模型具有自己的特点:首先,佳格做预测的数据是更精确均匀的卫星数据。其次,佳格运用模型最优化方法,综合考虑多种国际上最先进的气候预测模型,通过算法选出动态的最合适的预测模型,用于预测未来五天内的空气质量情况。

张弓在最后的演讲中也提到,大数据的潜力还没有被完全挖掘出来,这需要时间和不断的尝试才能发挥它最大的价值,更好的改善我们的日常生活环境。

本文转自d1net(转载)

时间: 2024-10-21 12:39:06

大数据如何改善我们周围的生存环境的相关文章

大数据技术改善民生前景广阔

2013年5月30日下午第二届京交会现场,天云大数据展台人头攒动,成为一大亮点.原来是汪洋副总理亲临展会视察.汪副总理在现场兴致勃勃地观看了天云大数据城市用电负荷实时监控系统应用演示,并向天云大数据CEO雷涛询问道:这是每栋楼的用电数据吗?雷涛介绍到:是每户的数据.以前每月抄一次电表,每年只有12条数据,现在能做到每15秒采集一条数据,一个城区每天就产生400TB数据.通过实时监控可以对不同功能区域进行合理的电力调配......汪副总理点头赞许.2012年10月,汪副总理主政广东期间就财政干部推

大数据如何改善社会治理:国外“大数据社会福祉”运动的案例分析和借鉴

一.背景 今年,国务院印发<促进大数据发展行动纲要>明确指出大数据将成为提升政府治理能力的新途径,提出:建立"用数据说话.用数据决策.用数据管理.用数据创新"的管理机制,-,推动政府管理理念和社会治理模式的进步. 与此同时,国外学术界和政府管理部门近年来也发起了一项"大数据社会福祉"(big data for social good)运动.与我国的目标相似,该运动也尝试将大数据技术与社会治理相结合,以数据驱动的方式应对现代社会中面临的一些复杂问题,增进社

大数据如何改善社会治理

去年,国务院印发<促进大数据发展行动纲要>明确指出大数据将成为提升政府治理能力的新途径,提出:建立"用数据说话.用数据决策.用数据管理.用数据创新"的管理机制--,推动政府管理理念和社会治理模式的进步. 与此同时,国外学术界和政府管理部门近年来也发起了一项"大数据社会福祉"(Big Data for Social Good)运动.与我国的目标相似,该运动也尝试将大数据技术与社会治理相结合,以数据驱动的方式应对现代社会中面临的一些复杂问题,增进社会福祉.在

雷军两会议案:开放大数据与改善创业环境

雷军3月6日消息,金山软件.小米科技董事长,全国人大代表雷军在两会期间做出两项议案,包括<关于加快实施大数据国家战略的建议>.<关于修订<公司法>优先股条款以改善创业环境的建议>.关于加快实施大数据国家战略的建议全国人大代表:雷军大数据的重要性毋庸置疑,目前主要是 各地政府出台了一些大数据行动计划或实施方案,但国家层面上没有制定切实有效的 大数据战略.我们迫切需要从国家层面上制定大数据发展规划.政府应研究大数据发展趋势,评估大数据对政府.经济与社会运行所带来的 革命性影

物联网和大数据如何改善食品安全?

大家普遍认为,物联网及其远程监测和控制系统的能力有助于进一步保障食品安全.果真如此吗? 近年来,关于物联网的文章层出不穷,其改变企业和公共服务运作方式的潜力不断引发热议.人们希望利用庞大的传感器网络,从世界各地的工厂.交通工具.医院.家庭.商店和供应链收集数据.而今,这一愿景正迅速成为现实.从可以优化交通.能源使用与标识体系的智慧城市,到能够预测地震的系统,物联网技术将帮助我们实现这一切. 只要看看数字,就知道所言非虚.2016年初,市场调研机构IDC曾预计,到2019年时,全球物联网市场规模将

大数据能改善学校教育吗?看国外让大数据如何在教育行业落地

在开始学游泳时,老师们都会让小朋友们手持浮板(Kickboard)练习游泳的基本技能.浮板作为一个辅助工具广泛地运用于游泳的教学之中.小编这次介绍的公司就是取名Kickboard,这个教育技术工具也是为了辅助教学,但它可不只是一个浮板.Kickboard是一个学校数据分析平台,能让学校的教师和领导更好地掌握.分析以及分享学生表现的数据,以此来改善教学.管理课堂.增进与家长的沟通. 其创始人说Kickboard就是教师的浮板,帮助他们更好地在学生数据的海洋里遨游.近年来,在教育领域大数据也成了热点

7种大数据方案重塑医疗行业

怀疑主义是一把双刃剑.如果没有怀疑主义的话,IT经理可能会去投资那些没有用处的软件.足够的怀疑,可以让IT部门等待足够的证据,以证明特定的平台可以带来好结果. 医疗行业的数据分析到达临界点 大数据分析现在已经到达了医疗行业的临界点.一些供应商承诺在减少开支的同时,会提供更好的医疗质量,但有证据表明这些说法是有争议性的.同样,一些大数据运动的批评者指出,医疗行业在开展大的项目之前,可以从小数据集榨取情报. 举例来说,在最近的一篇博客文章中,顾问兼医学博士David C. Kibbe和Vince K

大数据浪潮填满了谁的腰包?

研究公司Wikibon发现,尽管以IBM及英特尔等为首的老牌劲旅正在大肆蚕食大数据市场所带来的丰厚利润,但充满创新能力的新兴企业才是左右市场未来的核心力量. 根据专业研究公司Wikibon的说法,如果对大数据市场进行具体量化,那么它目前的总价值已经超过50亿美元,而且其中大部分份额掌握在几家传统的IT领头羊手中.而当这些巨头们的注资与勇于创新的后起之秀们干柴烈火一相逢,市场的总价值将达到2013年的102亿美元,而到2017年这一数字更加攀至530亿美元的高峰. 不过情况也很可能没这么乐观.我们

生态环境大数据风头正劲 信息化推动管理新聚合

大数据风头正劲.发展大数据的目的是发现新知识.创造新价值,那么生态环境大数据究竟能给环境管理创造哪些价值?带来哪些变化?作为新生事物,生态环境大数据建设之路仍需要探索.我们要积极扫除障碍,理清思路,为生态大数据的发展创造良好环境. 以改善环境质量为核心,实行最严格的环境保护制度,不断提高环境管理系统化.科学化.法制化.精细化和信息化水平,加快推进生态环境治理体系和治理能力现代化,是环境保护部谋划"十三五"工作的思路和规划.其中,信息化作为"五化"之一,其重要作用将越