医疗大数据的技术难题:收集信息

  6月8日消息,科技博客网站recode.net今天发表文章称,许多机构的研究人员正在探索如何利用人工智能和大数据,为癌症等疑难病症找到更好治疗方法,目前已取得进展,但他们在收集患者信息上遇到难题。

  文章主要内容如下:

  IBM、波士顿制药公司 Berg Pharma、纪念斯隆-凯特琳癌症中心(Memorial Sloan Kettering)、加州大学伯克利分校(UC Berkeley)及其它机构的研究人员,正在探索如何利用人工智能和大数据,找到更好的疾病治疗方法。

  但是,在医疗领域充分利用这些计算工具面临的最大挑战是,这方面的海量数据被束之高阁——或者说从一开始就没有数字化。

  早期的医学研究成果或病人的病历,往往锁在医药公司的档案或医生办公室的文件柜中。

  病人的隐私问题、公司间的利益冲突以及纯粹缺乏电子病历,阻碍着医疗领域的信息共享,让每一次治疗都像一个孤立的事件。如果医疗领域的信息共享能取得进展,人们很有可能发现更具普遍意义的治疗方案。

  加州大学旧金山分校的讲师迈克尔·凯泽(Michael Keiser)指出,当你能够对10万个病人的临床试验数据、基因组数据和电子病历进行分析时,与以往只能接触少数病人的信息相比,你将能发现以往所不能发现的治疗方案。

  鉴于这样的前景,一些组织开始着手将医疗数据整合在一起。

  去年年底,美国临床肿瘤学会(American Society of Clinical Oncology,ASCO)宣布了旗下“CancerLinQ”项目的初步进展情况。“CancerLinQ”是一个“快速学习系统”,允许研究人员进入、访问和分析匿名癌症患者的病历。

  今年4月,一个有众多主要制药公司参与的非营利性组织——“癌症生命科学协会CEO圆桌会(the CEO Roundtable on Cancer)”,宣布推出PDS计划(Project Data Sphere)。该计划将打造一个第三阶段癌症临床试验数据共享和分析平台,初始数据集已由阿斯利康、拜耳、新基医药(Celgene)、纪念斯隆-凯特琳癌症中心、辉瑞、赛诺菲等共同提供。

  这些数据已去除患者的个人信息,并进行了统一编号,供生命科学公司、医院、医疗机构以及独立研究者可以免费使用。他们可以访问平台内置的分析工具,或者将数据插入到自己的软件中。

  癌症CEO圆桌会议首席执行官马丁·墨菲(Martin Murphy)表示,PDS计划可能有助于发现鲜为人知的癌症候选药物,这些药物可能对某些癌变有一定的疗效。而在某一特定研究中,这些药物可能会因为没有达到研究的主要目标而被抛弃。

  其它推进医疗领域信息共享的努力还包括:由从多医疗机构、研究型大学、生命科学公司等组建的全球基因组学与健康联盟(Global Alliance for Genomics and Health)、欧洲生物信息研究所(EMBL-EBI)维护的分子生物数据库,以及美国国立卫生研究院(National Institute of Health, NIH)成立的“生物标记共同体(Biomarker Consortium)”等。

  与此同时,用大数据服务肿瘤医疗行业的初创公司Flatiron Health上月完成了1.3亿美元 B 轮融资,由谷歌旗下风投机构谷歌风投(Google Ventures)领投。Flatiron Health 打造了一个“肿瘤学云平台(OncologyCloud)”,能提取和整合病人电子病历(EMR)中的临床数据以及医疗费用数据。

  该系统使在医生办公室和医院以不可持续和非结构化格式留存的数据变得有意义,从而能够对大规模癌症患者群体的治疗情况进行分析。理想情况下,它可以发现哪种治疗方法对哪些类型的癌症患者有效。

  Flatiron Health 联合创始人奈特·特纳(Nat Turner)表示:“Flatiron Health专注于所谓‘真实世界’患者的临床资料。在美国,只有4%的癌症患者会参与前瞻性临床试验,因此我们正在努力提取和整合剩下96%患者的数据。”

  他说:“要真正了解什么对癌症有效,其他患者正在接受什么样的治疗,以及癌症领域的研究取得了什么样的成果,相关机构应该开放“去识别(de-identified)”的医疗数据和匿名的典型病例,这是Flatiron Health愿景的一部分。”

  隐私风险

  可以肯定的是,推进医疗信息的开放应该非常谨慎。医疗信息是高度敏感的,所以任何隐私风险需求应慎重考虑。

  医疗信息能开放到什么程度,取决于全社会所做出的让步。许多人坚定地持有这样的观点:挽救生命最重要。但受旧习惯和过时规章制度的影响,社会的转变速度还不够快,这一点加州大学伯克利分校的计算机科学教授大卫·帕特森(David Patterson)深有感触。帕特森致力于用于癌症研究的机器学习工具。

  他说:“对于计算机领域的研究人员,我们习惯于互联网时间和摩尔定律。但现在我们无法让官方达成一致,让我们能够大量快餐收集数据并进行整合,这是非常令人沮丧的。”

  他指出:“患者的隐私很重要,但争取癌症治疗领域取得进展同样很重要。将大量治疗信息汇集在一起的好处是,我们可以在攻克这种可怕疾病方面取得进展。”

  这些接受采访的专家,还没有谁能例举出目前为止大数据等计算技术对癌症治疗带来了什么突破。毕竟,这些技术都是新的,而且医疗数据集刚刚整合在一起,临床试验又需要数年时间。

  但几乎所有人都同意,在癌症治疗方面,研究人员正处于重大突破的边缘。

  墨菲称,如果把攻克癌症比喻为一座高山,目前已接近顶峰的边缘,这一高度是前所未有的。

时间: 2024-09-29 04:24:45

医疗大数据的技术难题:收集信息的相关文章

医疗大数据可治病为时过早

要问谁可以担当这两年的年度热词,移动互联网一定会成为当之无愧的首选.仿佛从2013年开始,无论哪个行业都在试图利用大数据掘金.在这其中,医疗产业的身影更是屡见不鲜.但是医疗大数据到底意味着什么?医疗大数据到底可以给http://www.aliyun.com/zixun/aggregation/32533.html">我们的生活带来哪些切实有效的帮助呢? 医疗大数据要先从收集开始 "我们总能听到一些人说,通过收集中国人的医疗大数据,我们就可以分析出中国人的疾病特征,从现在的生病以后

如何唤醒沉睡的医疗大数据?

本文讲的是如何唤醒沉睡的医疗大数据?[IT168 评论]近年来,很多国家都在积极推进医疗信息化发展,在临床辅助决策.医疗质量监管.疾病预测模型.临床试验分析.个性化治疗等方面的应用,大数据都将发挥巨大的作用.然而随着医疗信息化进程的加快,医疗行业早就遇到了海量数据和非结构化数据的挑战.尽管我国拥有海量的大数据,但缺乏有效的加工分析能力.我国在医疗大数据方面的发展并不乐观,医疗大数据的利用率仍然很低. 由于数据的来源依旧十分复杂,不同地区,不同医疗机构,不同计算平台所提供的数据并不具备完全真实的参

深度丨中科院田捷博士:基于医疗大数据和AI技术的影像组学及其应用丨CCF-GAIR 2017

7月9日,在由中国计算机学会(CCF)主办,雷锋网.香港中文大学(深圳)联合承办的CCF-GAIR 全球人工智能与机器人峰会的第三天,在未来医疗专场上,田捷博士做了"基于医疗大数据和人工智能的影像组学及其应用"的主题演讲. 田捷博士,是中国科学院自动化研究所研究员.Fellow of IEEE,SPIE,IAMBE,AIMBE,IAPR.其主要从事医学影像分析与生物特征识别的研究和应用的工作.田捷博士的很多学术论文.研究成果,均可见自国内外的各学术杂志和学术会议上,学术论文达上百篇.

智慧医疗迎风口 医疗大数据“信息孤岛”仍待破解

国务院办公厅发布<关于促进和规范健康医疗大数据应用发展的指导意见>(下称"<意见>"),将健康医疗大数据应用发展纳入国家大数据战略布局.国家卫计委规划与信息司副司长张锋认为,<意见>有利于打破信息不对称格局,提升全体人民健康医疗服务可及性. 不过,目前医疗机构数据比较分散,信息孤岛仍是待破之题.一份调查显示,当前已有70%以上的医院实现了医疗信息化,但仅有不到3%的医院实现了数据互通. 中国医院协会常务副会长.秘书长薛晓林向21世纪经济报道记者指出,

信息加速累积下 医疗大数据存在的几种潜在变现能力

 医疗行业是典型的数据密集型行业,医疗信息数据一直是医疗健康领域最重要的核心.随着数据生成和共享的速度急速增加,医疗数据加速累积.IDC曾预测截至2020年全球医疗数据量将达到40万亿GB,大约是2010年的30倍之多.可以说,信息化和医疗数据的规模和质量推动了医疗健康的进步和发展. 而医疗大数据产业的发展是由价值医疗驱动的,也就是医疗服务质量与医疗成本的双赢,其潜在的价值空间非常巨大.医疗大数据产生于具体的应用场景,服务于居民.医疗服务机构.科研机构.公共健康管理部门,医疗保险管理机构以及商保

浅谈医疗大数据面临的技术挑战

医疗大数据的本质是数据.在医疗行业,医生的诊治是一个过程,需要将患者疾病状态或治疗过程记录下来.由于医生对疾病的认识不同,因此所记录的"事实"会有所不同,特别是缺乏经验的医生,经常会忽略记录重要的病历信息,可能因此出现数据丢失,也可能导致所记录的数据没有准确地反映出客观的事实. 医疗大数据 大数据时代,数据来源于外部,不由自己把控.如果获取的是不真实的数据,无法得出有价值的结果,更多情况下可能是误导.所以,一定要认识到,数据并不是越多越好,数据质量非常重要,把握数据的含义也非常重要.

医疗大数据的发展现状与应用

目前我国的医疗行业现状是,优质医疗资源集中在大城市,地方以及偏远地区医疗条件较差,医疗资源的配置不合理,导致了大量的长尾需求,催生了广阔的互联网医疗市场.在此背景下,互联网的"连接"属性得以发挥,有效提高了长尾市场的信息流通,降低了产品扩大受众群的成本,而大数据技术的应用能够使得医疗服务更加完善和精准. 医疗大数据的应用主要指的是将各个层次的医疗信息和数据,利用互联网以及大数据技术进行挖掘和分析,为医疗服务的提升提供有价值的依据,使医疗行业运营更高效,服务更精准,最终降低患者的医疗支出

医疗大数据的“苟且”与远方

    编者按:2016年6月8日国务院总理李克强主持召开国务院常务会议,确定发展和规范健康医疗大数据应用的措施,通过互联网+医疗更好满足群众需求.2016年6月21日,经李克强总理签批,国务院办公厅日前印发<关于促进和规范健康医疗大数据应用发展的指导意见>(国办发[2016]47号文件).医疗大数据产业或将迎来史上最重要的一次爆发机遇.当然,机遇与挑战永远并存,现实的障碍和困惑着实令人有些无从下口之感. "我希望能和互联网创新公司合作,来打造一个'临床遗传机器医生',解决罕见遗传病

大数据的应用难题:是否该建立数据公地

文章讲的是大数据的应用难题:是否该建立数据公地, [IT168评论]要想考察大数据最好同时考察大数据背后的技术.商业和社会维度.从发展成熟度来看,技术维度走的最远.商业维度有所发展但不算全面成熟,社会维度发展最差.所以虽然已经谈了很久大数据,但除了孕育出大数据自身的几个领域比如搜索等,其它领域却并没有从大数据中获得可见的收益.大多时候人们还是处在觉得这里肯定有金子,但需要更多的耐心的状态.这篇文章则尝试对大数据本身的特征做点挖掘,对未来的发展趋势做点预测. 大数据上的深度和广度 如果把大数据对应