华大基因借助英特尔微异构加速基因测序

  基因测序,一直就是科学家不断地孜孜追求破译生命遗传信息的关键方法,而其海量、复杂、多变的">数据计算需求一直是横越在前行道路上的一道鸿沟。随着多年来超级计算机的不断发展,高性能计算在基因测序发展上发挥了重大的助推作用。而作为中国首屈一指且世界知名的基因研究机构——华大基因,其借助高性能计算优势在基因测序相关研究及应用上作出了令人瞩目的成绩,而其在全新基于英特尔微异构架构的高性能计算平台上的测试,取得了重大进展进一步加速了基因测序。

  高性能计算助力基因测序

  “每个人约有1万亿个细胞,每个细胞里面都有23对染色体,这些染色体中包含的DNA由ATCG不同碱基序列构成,数量共计达30亿,这些基因序列就是破解人类遗传信息奥秘的钥匙”,华大基因高性能计算研发主管王丙强博士介绍到,基因测序工作就是要通过大规模的计算分析从海量的数据信息中辨识载有的基因及其序列,最终获取遗传信息。

  人类基因组计划 (human genome project, HGP)旨在绘制人类基因组图谱最终达到破译人类遗传信息目的,该计划于1990年正式启动,而这也正是催生华大基因成立的重要原因。庞大而复杂的海量数据早已超出人类计算的能力,要想及时且准确地大规模处理这些数据就不得不依靠计算机的高性能计算。“华大基因一直非常重视高性能计算平台的建设”,王博士介绍到,华大基因建立了基于高性能计算的大规模测序、生物信息、克隆、健康、农业基因组等技术平台,其测序能力及生物信息分析能力世界领先。自1999年成立以来,华大基因成功完成了国际人类基因组计划“中国部分”在其中承担了绝大部分工作,并在Nature和Science等国际一流的学术杂志上发表百余篇学术论文,奠定了中国基因组科学在国际上的领先地位。

  华大基因目前已在深圳、香港、北京和武汉等地建立多个大型生物信息超级计算中心,总峰值计算能力达到200T flops,总内存容量达到35TB,总存储能力达到16PB。这为海量生物信息学数据的存储、处理和分析提供了稳定而高效的保障。其中位于深圳和香港的两个中心,是目前中国最大的两个生物信息超级计算中心。

  华大基因展示的杂交石斑鱼,其生长速度和体重是普通石斑鱼的2-3倍,而且口感更好

  至强融核进一步加速基因测序

  在寻求更快更高效的高性能计算基因测序方案的过程中,华大基因一直在尝试新的技术和方法来进一步加速基因测序。面对复杂的基因测序数据处理,既要拥有高性能的计算能力,又要考虑其经济效益,并结合未来在相关研究的发展,经过多番考量和研究,华大基因最终选择了与英特尔联手启动关于至强融核协处理器在生命科学领域的应用项目。

  至强融核协处理器(Xeon Phi)是英特尔面向高度并行的高性能计算(HPC)应用所推出的协处理器,能够提供多达 61个内核、244个线程和 1.2万亿次浮点运算性能,此外其余英特尔至强处理器架构使用同样的编程语言、并行模式、技术和开发人员工具,具有迁移便捷编程可移植等优势。

  “我们愿意尝试英特尔至强融核,首先是看中了其编码的简单可移植性,这是来自基因测序相关程序的重要需求;其次,我们在未来想借助2013年在全球高性能计算机500强排名第一的广州天河二号超级计算机的计算能力,而它就正是就基于英特尔微异构的。”华大基因高性能计算研发主管王丙强博士介绍到。

  英特尔微异构效果超出预期

  华大基因在基因测序计算中应用的是BWA(Burrows-Wheeler Aligner),是基因研究中一款十分优秀并且被广泛使用的序列比对软件。“由于BWA软件代码分支多,并且有很多随机访问,起初我们认为BWA移植效果可能不会太好”,王丙强博士介绍到,“然而,实际测试的性能表现非常不错,大大超出了我们的预期,我们共尝试了6种优化方法,获得的最好加速比能达到2.19。”

  值得一提的是,微异构代码迁移和优化上也带来了很多优势,王丙强表示,代码的修改工作量的确不大。“只需要对源代码进行很小幅度的修改,是添加一些辅助编译指示,就能在微异构上运行的相当好。”他说。

  更强计算力加速生命解谜

  在测试基于英特尔微异构的高性能计算平台的同时,华大基因也正在执行3M百万基因组计划,即百万动植物基因组计划、百万人基因组计划、百万微生态基因组计划,该项目将联合全球科学家,通过上百万样本的测序构建遗传信息的数据库,进一步推动基因组测序和生物信息分析技术在粮食安全、医学应用、生态保护等重大发展问题的应用。

  “当面对如此规模的数据的项目时,华大基因的计算能力仍显得有些不足,因此一方面我们不断扩充自身的数据中心,另外也在考虑借助天河二号这样的超级计算机的计算能力”,王丙强博士介绍到,“这些项目对计算能力的需求非常大,未来就看微异构如何来加速这些基因测序的计算和分析了。”

(作者:李祥敬责任编辑:李祥敬)

时间: 2025-01-21 12:43:50

华大基因借助英特尔微异构加速基因测序的相关文章

英特尔微芯片架构负责人中风下任CEO可能人选

CNET科技资讯网3月2日国际报道 英特尔微芯片架构部门负责人,被认为很可能成为Paul Otellini接班人的Sean Maloney近日在家中中风,他将休几个月的病休. 英特尔周一表示,Sean Maloney将病休几个月时间. 分析师认为,英特尔已经将53岁的Maloney列为CEO Paul Otellini的接班者. 英特尔股票周一在盘后交易中曾被短暂停牌.当英特尔发布公告后,公司股票又被复牌,当日收于20.87美元一股. Maloney所在的部门主要负责英特尔微处理器的设计与研发工

XSKY借助英特尔SPDK提升Ceph性能

NVMe是新一代的PCIe固态硬盘接口规范,其目的是统一主流厂商的SSD接口交互标准,并更好的对上层系统释放效率潜能.NVMe标准的倡导者包括英特尔.三星.美光.Oracle.微软.Dell.HGST.希捷等行业领先企业,2014年11月发布版本1.2标准. 市售的基于NVMe硬盘动辄可达到单盘GB级的读写带宽和十万量级的随机IOPS,为SATA固态硬盘的5~10倍.然而,由于Linux内核驱动实现与调度机制的限制,主流的软件定义存储系统并不能完全释放其性能,同时,对CPU等系统资源消耗巨大,为

直击英特尔IDF16:加速万物智能互联世界到来

4月13,IDF16在深圳拉开了序幕.这已经是该活动连续第三年在这里举行,和过去一样,IDF16大会依然是一场技术盛宴:有机器人.VR等各种炫酷的黑科技,也有服务器芯片这些传统高科技,还有对云计算.大数据等热门话题的探讨,让人眼花缭乱.而种种展示背后不无透射出英特尔正致力带给我们的一个"万物智能互联"的新世界. "技术在不断地演变,计算的范围在不断地扩展,计算变得无处不在,进入我们的衣服.汽车和家里."英特尔全球副总裁兼中国区总裁杨旭的大会演讲表示,世界正在向万物智

英特尔收购Lantiq 加速进军物联网市场

芯片巨头英特尔收购了德国网络芯片制造商Lantiq,但具体收购价格不详,这次收购属于英特尔"让一切智能互联"计划的一部分. Lantiq拥有超过2000多项专利,有望推动英特尔"connected home"和"intelligent network"市场.这次收购是这家科技巨头进军所谓的"物联网"市场的最新动作:英特尔于2013年11月设立了一个专门致力于物联网的部门.去年谷歌以32亿美元的价格(21亿英镑)收购了智能自动调

【Intel】英特尔:三驾马车驱动开放云计算

近一年多来,IT业界在开放的架构和开放的生态系统将是推动云计算发展的关键动力上达成共识后,不少IT厂商和企业用户就把目光投向了英特尔公司,这一方面是因为英特尔已借助开放架构和开放生态系统的优势成就了在服务器.存储和以太网等与云计算载体--数据中心密切相关的领域的优势地位:另一方面,也是受到了它于2010年10月正式发布的2015云愿景的感召. 英特尔的2015云愿景完全可被视为一个构建理想云计算平台的具体行动纲领,或是方向明晰的技术创新路线.根据英特尔的说明,其三大要素--"互通".&

英特尔马子雅:深度学习四大痛点与BigDL解决之道

   [51CTO.com原创稿件]在万物智能互联时代,数以亿计的智能互联设备及其产生的数据洪流带来了产业的数字化变革.越来越多的企业希望借助机器学习与深度学习,从海量数据中获取切实可行的洞察以指导企业决策.创造更多价值.借助计算.存储和网络等基础设施的优势,英特尔在数据分析与人工智能领域深耕已久,并通过与合作伙伴的合作,给用户提供了端到端的软硬件全平台解决方案.近期,由O'Reilly Media和Cloudera联合举办的Strata Data Conference大会在京召开.期间,笔者受

全新英特尔至强处理器 加速数据中心转型

3721.html">2014年9月8日,英特尔公司推出了英特尔至强处理器E5-2600/1600 v3产品家族,旨在满足多样化工作负载的需求以及数据中心快速变化的需求.全新的处理器产品家族具有多种增强特性,相比上一代产品可获得多达3倍的性能提升,以及一流的能效和增强的安全特性.为满足对软件定义基础设施(SDI)的爆炸性需求,这款处理器还能通过遥测技术提供关键参数,帮助基础设施以出色的性能.弹性和优化的总体拥有成本来交付服务. 这款处理器可用于服务器.工作站.存储和网络基础设施之中,能够支

英特尔阐述数据战略:做中国高价值合作伙伴

今天,英特尔公司在北京举行2017中国战略分享会,主题为"The NEXT--驾驭数据洪流,共立巨浪之巅".此次活动从数据大趋势.英特尔转型大格局.创新增值大机会三大方面,全面阐述了英特尔如何在智能互联新形势下,以清晰的战略和全新的能力,进一步加深与中国产业的合作创新并共创未来的举措和进展. 英特尔公司全球副总裁兼中国区总裁杨旭在主题演讲中表示,"当今数据洪流席卷全球,而中国是数据大国.英特尔作为一家数据公司,关注未来数据.我们与中国产业伙伴深度合作,挖掘数据的价值,推动经济

英特尔Nehalem处理器刀片式服务器导购

&http://www.aliyun.com/zixun/aggregation/37954.html">nbsp;   随着英特尔Nehalem架构至强5500系列处理器的发布,如何将新架构带来的优势转化为IT应用价值,并以此赢得客户的青睐,成为了众多服务器厂商抢占市场先机的关键. 英特尔公司发布了15年来最重要的服务器产品--基于英特尔微体系架构的英特尔至强5500系列处理器.英特尔表示,该系列处理器拥有突破性潜能.卓越的性能以及出色的能效表现,能带来智能化.数据中心能耗控制以