李辰:技术提取智慧 领衔大数据时代

人工智能的终极目标是让机器能够像人一样思考和做事。但是如果机器不能够理解人的语言,那么就不可能实现人机交互,更不可能自主学习。毫无疑问,有关自然语言处理的研究对于解放人类大脑,是继工业革命解放了人类的身体之后的又一次解放。自然语言处理的诱人前景正使得它越来越成为研究的热点。

孜孜爱国情

李辰专注于人工智能领域的自然语言处理新算法及其在生物文本挖掘领域的应用的研究由来已久。2005年李辰加入位于英国剑桥的全球著名的生物信息研究所—欧洲生物信息研究所(EMBL-EBI)以来,一直从事生物医学数据挖掘的研究、开发工作,尤其是基于自然语言处理自动从文本中提取生物医学知识。2010年,他从众多候选者中脱颖而出,被英国剑桥大学授予海外Fellowship。同年,他通过了EMBL-EBI的严格审核,科研项目被采纳在EMBL-EBI进行,成为一位来自非欧盟国家的入选者。在获得剑桥大学博士学位后,他受邀加入麻省理工学院计算机与人工智能实验室,在实验室前任主任、美国工程院院士Victor Zue的团队任博士后研究员,继续专注于基于自然语言处理的文本数据的深度理解研究。在EMBL-EBI积累的生物学科研经历使得李辰对基于自然语言处理的生物文本挖掘这一跨学科领域具有独到的见解。

“树高千尺,不忘根本”。走得越远,对故乡的怀念却越深。这些年,他在外求学做研究的同时,也从未停止过对祖国的关注。“只要心存对事业和对祖国的热爱,什么都不能阻挡我前进的步伐。”决定回国前,排在世界五百强企业前列的UnitedHealth邀请他担任高级管理人员,报酬待遇非常优渥。李辰婉拒了。他还是很希望为国效力。2016年,李辰获得中组部“千人计划”青年人才和西安交通大学“青年拔尖人才计划”,回到了心心念念的祖国,任职于西北这片广袤的土地上,开始了新的科研旅程。

大数据的核心——数据挖掘

大数据是一种内容庞大而又多样化的信息资源,被认为是等同于人力资源和物质资源的国家重要战略资源。大数据的价值,不仅仅在于拥有海量的数据信息,更重要的是在于对这些含有意义的数据进行专业化处理,提取最具价值的信息,挖掘找到人们所需要的有价值的东西。人工分析这样大量的数据显然是不现实的,必须要有高效的方法。

数据挖掘是近年来新兴的一种科学计算技术与数据分析方法,它能够有效地从大量数据中提取潜在的信息与知识。在生物信息领域,一系列挖掘算法和挖掘模式的研究提出,并应用于生物数据,取得了传统生物计算技术无可比拟的效果。

在当前大数据时代,重视生物信息学的发展极为重要,也更加需要计算机技术的支持。计算机辅助计算将是生物大数据分析的必由之路,也必将成为生物研究中的中流砥柱。对这一点,李辰坚信不疑。他所带领的生物医学文本挖掘研究组专注于研发数据驱动的机器学习模型和算法,来深度理解文本数据。并积极将科研成果转化为应用。在生物信息领域,这些成功应用对于解决生命学科的重大问题具有深远的意义。

把“不可能”变成“可能”

“在科研领域里,意识到一种天才的研究方法,其价值并不在发现本身之下。”在计算机语言方面,李辰研究网络的思维方法无疑是领先一步的。

如何能让计算机智能地帮我们理解这些文献,从中自动提取出有价值的知识呢?海量的生物网络反应能够被计算机理解是第一步。李辰支持研发了BioModels数据标准及分析系统,创新性地构建了一个集智能存储、搜索和模拟生化反应网络数学模型的开放平台。这一标准填补了生物信息学领域的网络模型的数据标准空白,成为生化网络模型的标准数据库之一,目前已经存有近十五万生物模型。BioModels也被评为系统生物学领域最重要的数据资源,并且得到多家权威国际学术出版机构的超过200种期刊的推荐。2014年,欧盟在其提出的欧洲生物信息架构计划(ISBE)的详细方案书中阐述了关于建立一个泛欧洲系统生物架构的迫切需要。BioModels被欧盟作为一个成功案例在欧洲生物信息架构计划(ISBE)的方案书中进行了分析。2014年,自然出版社对该系统进行了专访。

在设计数据标准将大量的生化网络数据进行整合后,李辰团队将新的语言模型引入生物文本挖掘领域。研发的多个基于机器学习监督算法的生物文本挖掘模型在领域公认的数据集上进行测试,所得结果证明这些模型的性能均达到国际领先水平。2016年,在生物医学文本挖掘的国际比赛BioNLP上,李辰团队研发的LitWay系统获得了SeeDev任务的第一名。在产学研应用方面,他们研发的新的生物网络提取架构使文本挖掘结果更加符合生物学科研究需求,从而拉近了生物文本挖掘科研与应用的距离。基于分析,进一步提出了结合篇章分析和生物信息学的从反应提取向网络生成的发展方向,得到了业内科研人员的认可。

没有超越现状的睿智和锐气,就没有人类的发展;没有强烈的创新意识,就没有人类的进步。看到李辰和他的团队,看到那股热烈的科研精神,我们也仿佛看到了这一新兴学科的无限可能和美好未来。

本文转自d1net(转载)

时间: 2024-10-21 15:49:13

李辰:技术提取智慧 领衔大数据时代的相关文章

NoSQL领衔大数据时代的新技术

本文讲的是NoSQL领衔大数据时代的新技术,大数据应用到数据集,其大小超出了常用软件工具所能捕捉.管理和在可承受的时间内处理数据的能力.Big Data的规模在不断变化,单一数据集的规模从几十个TB涨到多个PB. IDC估计到2011年数据约达到1.8ZB. ZB有多大?答案是10亿个TB.目前世界人口有7亿--也就是说,如果给每个人250G硬盘--存储空间仍然是不够用的. 这次的数据洪流有诸多来源: 1. 纽约证券交易所每天产生1TB的新交易数据; 2. Facebook主机存储100亿张照片

Sybase中国技术总监卢东明:大数据时代的数据库挑战

日前,在Sybase IQ 15.4媒体活动上,CSDN联合几家技术媒体共同采访了Sybase中国技术总监卢东明.卢东明就大数据给传统数据库厂商的冲击.列式和行式数据库的比较.以及其他热点话题分享了看法. Sybase中国技术总监 卢东明 卢东明首先简单介绍了SAP旗下的5大数据库产品: Sybase Adaptive Server Enterprise简称ASE(行式数据库) Sybase IQ(列式数据库) Sybase SQL Anywhere(小型嵌入式数据库) HANA(完全基于内存.

济南发力大数据和智慧城市 大数据时代的济南智慧

人类文明的每个阶段都有一张最具代表性的标签.大数据,或许是最有希望成为时代标签的候选者.大数据是一类数据,是一项技术,更是一门产业.大数据技术的底层性使它极易与其他行业.技术嫁接,从而形成受众广泛.影响深远的产业革命. 政府工作报告提出,要加快大数据产业发展,打造济南数据科学中心,争创国家级大数据综合试验示范区和国家新型智慧城市试点.这一表态再次释放了济南发力大数据的前行信号. 大数据的大使命:济南经济增长新动力 前行.前行.再前行,这个春天济南向大数据连续发出信号. 政府工作报告提出,大数据是

赛迪顾问:大数据时代企业须打好信息资源整合攻坚战

ZDNET至顶网CIO与应用频道 06月23日 北京消息:数据被认为是新时期的基础生活资料与市场要素,重要程度不亚于物质资产和人力资本.近年来,企业产生的数据量呈指数级增长,信息资源爆炸式激增,其中非结构化的数据信息达到85%左右,传统的信息资源管理技术已经无法应对大数据时代的挑战.Hadoop等大数据技术和其他大数据工具和设备的出现以及云计算数据处理与应用模式的广泛运用,为企业处理日益增长的海量非结构化数据提供了高效.可扩展的低成本解决方案,弥补了传统关系型数据库或数据仓库处理非结构化数据方面

浅析大数据时代信息安全面临的挑战与机遇

"世界的本质是数据,大数据开启了一次重大的时代转型,也是一场生活.工作与思维的大变革".随着世界各大国在陆.海.空.天.电.网多维度战略的紧张部署,信息技术爆炸式发展.基于大数据发展对国家.社会的组织结构和治理模式,对商业.企业的决策方式和业务策略,对个人的生活思维方式等各方面产生的深刻影响,各界逐渐开始关注"信息"本身而不只是"技术"了.在大数据时代,人类信息管理准则也将面临重新定位,而在信息安全问题日益突出的当下,大数据给信息安全带来新挑战的

大数据时代 企业须打好信息资源攻坚战

文章讲的是大数据时代 企业须打好信息资源攻坚战,数据被认为是新时期的基础生活资料与市场要素,重要程度不亚于物质资产和人力资本.近年来,企业产生的数据量呈指数级增长,信息资源爆炸式激增,其中非结构化的数据信息达到85%左右,传统的信息资源管理技术已经无法应对大数据时代的挑战.大数据技术和其他大数据工具与设备的出现,以及云计算数据处理与应用模式的广泛运用,为企业处理日益增长的海量非结构化数据提供了高效.可扩展的低成本解决方案,弥补了传统关系型数据库或数据仓库处理非结构化数据方面的不足,深化和拓展了企

大数据时代

 前两天,在环球上看到一条新闻--京津冀一体化首枚棋子落定 中关村牵手河北高新区,点开后,发现提到我的家乡,"近日从北京中关村管委会获悉,今年起中关村将牵头建立一条"京津冀大数据走廊",依托三地大数据上下游企业自发形成的联盟,推动京津冀形成大数据产业带.张北草原,常年风寒.不久后一座密布金属网格的四方建筑将成为这里的新地标,这是中关村的北京国电通网络技术有限公司与张北县政府合作建设的大数据中心.数据中心会产生巨大的热量,张北的低温和大风可为其降温,同时张北生产的风电也将满足大

大数据时代的上海商业新模式

当前,对商业的定义是全新的大商业,互联网的发展.移动技术的应用,大数据时代的分享."互联网+"的强强联手以及线上线下的融合,新一轮的商业变革在不断创新.突破乃至颠覆中进行.上海市商业企业管理协会会长王志刚在日前召开的上海市和谐商业企业和上海商业优秀企业家表彰大会上表示. 在本届会议上,王志刚宣读了<关于表彰第十一届上海市和谐商业企业的决定>和<关于表彰第十四届上海商业优秀企业家的决定>.上海联华超市.上海奥特莱斯品牌直销等14家企业荣获"第十一届上海市

大数据时代企业信息化如何应对?

随着科技进步.社会发展,信息量越来越大,数据渗透到各行各业,不少企业的数据也越来越被重视,博宏云谷为客户建立了专门的大数据服务部门,对客户的需要数据进行收集与分析,提供基于大数据的运营指导.未来将会是一个大数据应用的时代,每时每刻数据都在膨胀增长,海量的数据将会成为企业制定战略决策的重要参照,关于大数据时代对企业信息化的影响,将从以下三个方面浅谈. 1.辅助企业认识用户 目前,对于企业来说,数据越来越重要,企业可以通过海量的数据的挖掘与分析,充分了解到用户需求 .电商网站可以通过消费者购买商品的