这种技术比当前最先进的方法快大约一百倍,且仅使用目前五分之一的资源。这项研究以单词而非字母为语言模型提供压缩的构建模块,全基因组从而可以更紧凑地表示基因组数据。
“我们可以在一台普通的笔记本电脑上快速组装整个基因组和宏基因组,包括微生物基因组,”MIT计算机科学和人工智能实验室教授波尼·博格说,“这种能力对于评估与疾病和细菌感染(例如败血症)相关的肠道微生物组变化至关重要,这让我们能够更快地治疗并挽救生命。”
自人类基因组计划开展以来,基因组组装项目取得了长足的进步,该计划于2003年完成了首个完整的人类基因组组装,耗资约27亿美元,并进行了十多年的国际合作。虽然目前完成人类基因组组装已不再需要耗费数年时间,但仍然需要几天时间和强大的计算机能力。第三代测序技术虽可提供具有数万个碱基对的、太字节数量级的高质量基因组序列,但事实上,将如此巨量数据的基因组进行组装,仍具有挑战性。
为了超越当前技术从而更有效地进行基因组组装,包括在所有可能的读数对之间进行成对比较,博格及其同事此次将研究目标转向了语言模型。他们基于“de Bruijn”图(一种用于基因组组装的简单、高效的数据结构)概念,开发了一种极小空间“de Bruijn”图,它使用被称为“极小值”的短核苷酸序列,代替单个核苷酸。
博格表示:“极小空间‘de Bruijn’图只存储总核苷酸的一小部分,同时保留了整个基因组结构,使它们比经典‘de Bruijn’图更有效。”研究人员利用新方法为661406个细菌基因组的集合构建了一个索引,这是迄今为止同类集合中最大的一个。他们发现,这项新技术可在13分钟内搜索整个集合中的抗菌素抗性基因,而使用标准序列比对这一过程需要7小时。
为打造一个高质量、高收录的外链平台,站长将针对所有普通用户投稿的内容进行审核,针对文章原创度、文章格式是否杂乱、外链数量是否泛滥等多个方面对投稿内容进行审核测评,只有满足条件的内容才会通过审核。
平台将持续严厉打击发布虚假不实信息内容,一经发现立即删除,且将对发布虚假内容的账号进行相应的处罚。
当用户等级达到2级及以上等级之后,可联系站长【QQ:724413399】免费升级至VIP会员组,将免费获得发贴免审核权限,以后发的帖子都将跳过审核直接发布成功!
双击表格可删除表格
1、本站资源,均来自网络,版权归原作者,所有资源和文章仅限用于学习和参考 。
2、不得用于商业或非法用途,否则,一切责任由该用户承担 !
3、本站内容如不慎侵犯了你的权益,敬请谅解,内容素材由网友自发上传并非本站意愿,您可参照《文章侵权处理流程》联系我方解决!