Advanced Search
发表时间: 2021年07月15日 DOI: 10.21769/BioProtoc.1010626 浏览次数: 6612
研究背景
近年来,二代 (高通量) 测序技术的快速发展以及测序成本的降低,为基因组数据的获 取提供了便利,也使得它目前已经广泛应用于解决系统发生关系、生物进化等领域的科学问题。然而,由于二代测序技术本身的一些局限性,例如测序序列长度远远小于分子可能的原有长度,且难以区分基因组中的重复序列;测序时覆盖度不均匀,影响组装质量;测序时存在一定比例的错误,影响组装结果;测序得到的大量数据也增加了计算的复杂性,故基于二代测序的基因组组装具有一定的难度,也会占用大量计算资源与时间。
本文提出了一套基于二代全基因测序的快速基因组组装流程,它整合了一系列快速、高效的生物信息工具,可以从低深度测序的原始数据中快速组装基因组。使用该流程与技术,在普通配置的台式电脑上组装完成单个物种基因组 (大小一般在0.1-2 Gbp) 仅需2-24 h。该方法已在弹尾纲、昆虫纲、蛛形纲等类群中得到应用,组装的 基因组数据也已成功应用于六足类 (如虱目) 的分子系统学研究中。
仪器设备
软件
本教程可以自行在服务器或个人电脑上安装好相关软件进行。相关软件的安装版本及使用说明如下。
也可在Windows系统预先安装好虚拟机VMware或VirtualBox,导入我们准备的虚拟镜像 (.vmdk)。该镜像已安装CentOS 7.3系统和所需的生物信息学工具,建议磁盘空间超过100 Gb (至少50 Gb)。CentOS 7.3系统具体信息及下载链接详见https://1drv.ms/f/s!Ak7sQGBGqlguq1gdk1KKIR7uwAfj。
实验步骤
您对这篇实验方法有问题吗?
在此处发布您的问题,我们将邀请本文作者来回答。同时,我们会将您的问题发布到Bio-protocol Exchange,以便寻求社区成员的帮助。
