当前位置: 首页 > wzjs >正文

硬盘做网站空间中国品牌设计50强

硬盘做网站空间,中国品牌设计50强,河北君卓展览装饰有限公司,培训seo哪家学校好01 NextDenovo 简介 适用于三代数据基因组组装! NextDenovo 是一个基于字符串图(String Graph)的长读段(如 PacBio CLR, ONT)从头组装工具。它采用类似于 Canu 的“先纠错后组装”(correct-th…
01 NextDenovo 简介

适用于三代数据基因组组装!

NextDenovo 是一个基于字符串图(String Graph)的长读段(如 PacBio CLR, ONT)从头组装工具。它采用类似于 Canu 的“先纠错后组装”(correct-then-assemble)策略(注:对于 PacBio HiFi 数据不进行纠错步骤),但相比 Canu 所需的计算资源和存储更少。  不适用HiFi!

组装完成后的单碱基准确率约为 98%–99.8%。如果需要进一步提升单碱基精度,推荐使用 NextPolish 进行后处理。

性能评估

对 NextDenovo 与其他组装工具进行了对比测试,使用的数据包括:

  • 人类和果蝇(Drosophila melanogaster)的 Oxford Nanopore 长读段数据

  • 拟南芥(Arabidopsis thaliana)的 PacBio 连续长读段(CLR)

结果表明:

  • NextDenovo 生成的组装更连续,contig 数量更少

  • 在组装一致性和单碱基准确性方面表现优秀

02 安装方法

依赖环境

  • Python(支持 Python 2 和 3)

python-pip增加下载速度-linux006-CSDN博客

  • paralleltask 模块(可通过 pip 安装):

    pip install paralleltask

下载并安装

m1
wget https://github.com/Nextomics/NextDenovo/releases/latest/download/NextDenovo.tgz tar -vxzf NextDenovo.tgz && cd NextDenovom2
git clone git@github.com:Nextomics/NextDenovo.git cd NextDenovo && make

测试运行

使用官方提供的测试数据进行测试:

nextDenovo test_data/run.cfg
03 使用
3.1:准备 input.fofn 文件(列出原始读段文件)

ls reads1.fasta reads2.fastq reads3.fasta.gz reads4.fastq.gz ... > input.fofn

input.fofn 是一个文本文件,列出所有输入的长读段(支持 fasta/fastq、压缩或非压缩格式)

3.2:创建配置文件 run.cfg

cp doc/run.cfg ./

  • 务必设置:

    • read_type(如:ont、clr、hifi)

    • genome_size(如:130m 表示 130 Mb)

  • 建议参考文档:

    • doc/FAQ:常见问题

    • doc/OPTION:参数说明,优化并行计算性能

3.3:运行组装
nextDenovo run.cfg
  • 组装序列输出路径:

    01_rundir/03.ctg_graph/nd.asm.fasta

  • 统计信息文件:

    01_rundir/03.ctg_graph/nd.asm.fasta.stat

04 个性化使用参数
4.1 输入(Input)

准备 input.fofn 文件

ls reads1.fasta reads2.fastq reads3.fasta.gz reads4.fastq.gz ... > input.fofn

input.fofn 文件中每一行是一个长读段文件路径(支持 fasta/fastq,压缩或非压缩)

配置文件(Config File)

配置文件是一个包含键值对(key=value)的文本文件,用于设定运行参数。以下是典型的 run.cfg 文件(原始文件位于 doc/run.cfg):

[General] job_type = local # 可选项:local, sge, pbs, slurm, lsf 等 job_prefix = nextDenovo # 任务前缀 task = all # 运行阶段:all / correct / assemble rewrite = yes # 是否覆盖已有目录 deltmp = yes # 删除中间文件 parallel_jobs = 20 # 并行任务数 input_type = raw # 输入类型:raw(原始)或 corrected(纠错后) read_type = clr # 读段类型:clr, ont, hifi input_fofn = input.fofn # 输入文件列表 workdir = 01_rundir # 工作目录 [correct_option] read_cutoff = 1k # 过滤短读段(低于此长度) genome_size = 1g # 估算基因组大小(支持 k/m/g 后缀) sort_options = -m 20g -t 15 # 排序参数:内存和线程 minimap2_options_raw = -t 8 # minimap2 原始比对参数 pa_correction = 3 # 并行纠错任务数 correction_options = -p 15 # 纠错参数(线程数) [assemble_option] minimap2_options_cns = -t 8 # minimap2 校正比对参数 nextgraph_options = -a 1 # NextGraph 组装参数

运行命令(Run)

nextDenovo run.cfg

输出文件(Output)

主输出文件:

workdir/03.ctg_graph/nd.asm.fasta

  • fasta 格式组装结果

  • 每条 contig 的头信息包括 ID、类型、长度、结点数

  • 连续小写字母表示弱连接,单个小写碱基表示低质量

统计文件:

workdir/03.ctg_graph/nd.asm.fasta.stat

  • 包含 N10–N90、总长度等基本统计信息

4.2 参数选项概览

全局参数(Global Options)

参数名含义
job_type作业系统类型(local, sge, slurm 等)
task任务类型:correct(纠错)、assemble(组装)、all(全部)
input_type输入类型:raw(原始)或 corrected(已纠错)
read_type读段类型:clr、ont、hifi
parallel_jobs并行任务数
workdir工作目录
input_fofn输入文件列表

纠错参数(Correction Options)

参数名含义
read_cutoff过滤低于此长度的读段
genome_size基因组大小估算
seed_depth期望的种子覆盖度(默认45)
blocksize并行拆分文件的最大尺寸(默认10g)
pa_correction并行纠错任务数(覆盖 parallel_jobs)
correction_options-p 线程数 等其他纠错参数

组装参数(Assembly Options)

参数名含义
minimap2_options_cns用于纠错读段之间的比对参数
nextgraph_options用于组装图构建的参数
04 引用

Hu J, Wang Z, Sun Z, et al. NextDenovo: an efficient error correction and accurate assembly tool for noisy long reads[J]. Genome Biology, 2024, 25(1): 1-19.


文章转载自:

http://wrouut3u.qtzwh.cn
http://TXqdkszC.qtzwh.cn
http://JWkVtXrF.qtzwh.cn
http://BTXNTXz1.qtzwh.cn
http://TFD7Rezv.qtzwh.cn
http://nvyPKI9e.qtzwh.cn
http://MA1iWdHm.qtzwh.cn
http://doI9INVK.qtzwh.cn
http://loCeffSV.qtzwh.cn
http://epdCH8Ef.qtzwh.cn
http://NBnTsW4e.qtzwh.cn
http://r3v2qQcB.qtzwh.cn
http://kE5vyvDI.qtzwh.cn
http://1pq3JK09.qtzwh.cn
http://4uR9bRVK.qtzwh.cn
http://YuJQc0Qv.qtzwh.cn
http://R5XIKfcx.qtzwh.cn
http://eluW4POo.qtzwh.cn
http://rAgRxP4m.qtzwh.cn
http://hWvGpHfC.qtzwh.cn
http://wvjZ5QOP.qtzwh.cn
http://8OC0vtXj.qtzwh.cn
http://0qeizKSR.qtzwh.cn
http://YlnzytpD.qtzwh.cn
http://ipmabwty.qtzwh.cn
http://jzpcouFH.qtzwh.cn
http://VB91aeSl.qtzwh.cn
http://7c10ersy.qtzwh.cn
http://Lu4S0KBF.qtzwh.cn
http://sm1x9tdn.qtzwh.cn
http://www.dtcms.com/wzjs/678757.html

相关文章:

  • 怎么免费从网站上做宣传印度购物网站排名
  • 网站设计改版网站首页建设
  • 如何创业做网站一键优化清理手机
  • 潍坊网站建设定制做网站能用python吗
  • 重庆制作网站开发app开发公司免费网站应用
  • 做移动网站快速排名做虚拟货币交易网站
  • 网站备案手续费wordpress 登录logo
  • 濮阳网站建设通图片南通网站的优化
  • 网站建设有哪些名词安徽省经工建设集团公司网站
  • 站内关键词排名软件wordpress qq登陆接口
  • wordpress 优惠主机没有网站seo怎么做
  • 网站关键词收录查询泉州建网站
  • 单页面组合网站微信开发有哪两种
  • 深圳网页建设公司seo研究协会
  • 意识形态 加强网站建设北京装饰公司名称
  • 外卖网站怎么做织梦做网站首页
  • 给人做网站网站做外贸没有网站需要注意什么
  • 做视频网站需要什么证业务外包的典型案例
  • 接项目做的网站郑州网络推广技术
  • 有没有网站学做总结建设医院网站ppt模板下载
  • 行业网站建设方案鞍山网站制作谁家好
  • 大庆市城乡建设局网站首页竞价账户托管的公司有哪些
  • 怎样推广网站南京网站设南京网站设计计
  • 金融类网站开发王野天
  • 设计网站公司力荐亿企邦wordpress前台视频上传
  • 兰州网络营销网站网站域名中文后缀
  • 南昌所有建设工程网站阿里云建网站
  • 网站制作 长沙模板之家如何免费下载
  • 建设网站网址是多少安徽网站优化哪里有
  • 简洁商城网站模板廊坊建设部网站