当前位置: 首页 > wzjs >正文

硬盘做网站空间中山市网站开发公司

硬盘做网站空间,中山市网站开发公司,平台推广赚钱,网页翻译在线翻译01 NextDenovo 简介 适用于三代数据基因组组装! NextDenovo 是一个基于字符串图(String Graph)的长读段(如 PacBio CLR, ONT)从头组装工具。它采用类似于 Canu 的“先纠错后组装”(correct-th…
01 NextDenovo 简介

适用于三代数据基因组组装!

NextDenovo 是一个基于字符串图(String Graph)的长读段(如 PacBio CLR, ONT)从头组装工具。它采用类似于 Canu 的“先纠错后组装”(correct-then-assemble)策略(注:对于 PacBio HiFi 数据不进行纠错步骤),但相比 Canu 所需的计算资源和存储更少。  不适用HiFi!

组装完成后的单碱基准确率约为 98%–99.8%。如果需要进一步提升单碱基精度,推荐使用 NextPolish 进行后处理。

性能评估

对 NextDenovo 与其他组装工具进行了对比测试,使用的数据包括:

  • 人类和果蝇(Drosophila melanogaster)的 Oxford Nanopore 长读段数据

  • 拟南芥(Arabidopsis thaliana)的 PacBio 连续长读段(CLR)

结果表明:

  • NextDenovo 生成的组装更连续,contig 数量更少

  • 在组装一致性和单碱基准确性方面表现优秀

02 安装方法

依赖环境

  • Python(支持 Python 2 和 3)

python-pip增加下载速度-linux006-CSDN博客

  • paralleltask 模块(可通过 pip 安装):

    pip install paralleltask

下载并安装

m1
wget https://github.com/Nextomics/NextDenovo/releases/latest/download/NextDenovo.tgz tar -vxzf NextDenovo.tgz && cd NextDenovom2
git clone git@github.com:Nextomics/NextDenovo.git cd NextDenovo && make

测试运行

使用官方提供的测试数据进行测试:

nextDenovo test_data/run.cfg
03 使用
3.1:准备 input.fofn 文件(列出原始读段文件)

ls reads1.fasta reads2.fastq reads3.fasta.gz reads4.fastq.gz ... > input.fofn

input.fofn 是一个文本文件,列出所有输入的长读段(支持 fasta/fastq、压缩或非压缩格式)

3.2:创建配置文件 run.cfg

cp doc/run.cfg ./

  • 务必设置:

    • read_type(如:ont、clr、hifi)

    • genome_size(如:130m 表示 130 Mb)

  • 建议参考文档:

    • doc/FAQ:常见问题

    • doc/OPTION:参数说明,优化并行计算性能

3.3:运行组装
nextDenovo run.cfg
  • 组装序列输出路径:

    01_rundir/03.ctg_graph/nd.asm.fasta

  • 统计信息文件:

    01_rundir/03.ctg_graph/nd.asm.fasta.stat

04 个性化使用参数
4.1 输入(Input)

准备 input.fofn 文件

ls reads1.fasta reads2.fastq reads3.fasta.gz reads4.fastq.gz ... > input.fofn

input.fofn 文件中每一行是一个长读段文件路径(支持 fasta/fastq,压缩或非压缩)

配置文件(Config File)

配置文件是一个包含键值对(key=value)的文本文件,用于设定运行参数。以下是典型的 run.cfg 文件(原始文件位于 doc/run.cfg):

[General] job_type = local # 可选项:local, sge, pbs, slurm, lsf 等 job_prefix = nextDenovo # 任务前缀 task = all # 运行阶段:all / correct / assemble rewrite = yes # 是否覆盖已有目录 deltmp = yes # 删除中间文件 parallel_jobs = 20 # 并行任务数 input_type = raw # 输入类型:raw(原始)或 corrected(纠错后) read_type = clr # 读段类型:clr, ont, hifi input_fofn = input.fofn # 输入文件列表 workdir = 01_rundir # 工作目录 [correct_option] read_cutoff = 1k # 过滤短读段(低于此长度) genome_size = 1g # 估算基因组大小(支持 k/m/g 后缀) sort_options = -m 20g -t 15 # 排序参数:内存和线程 minimap2_options_raw = -t 8 # minimap2 原始比对参数 pa_correction = 3 # 并行纠错任务数 correction_options = -p 15 # 纠错参数(线程数) [assemble_option] minimap2_options_cns = -t 8 # minimap2 校正比对参数 nextgraph_options = -a 1 # NextGraph 组装参数

运行命令(Run)

nextDenovo run.cfg

输出文件(Output)

主输出文件:

workdir/03.ctg_graph/nd.asm.fasta

  • fasta 格式组装结果

  • 每条 contig 的头信息包括 ID、类型、长度、结点数

  • 连续小写字母表示弱连接,单个小写碱基表示低质量

统计文件:

workdir/03.ctg_graph/nd.asm.fasta.stat

  • 包含 N10–N90、总长度等基本统计信息

4.2 参数选项概览

全局参数(Global Options)

参数名含义
job_type作业系统类型(local, sge, slurm 等)
task任务类型:correct(纠错)、assemble(组装)、all(全部)
input_type输入类型:raw(原始)或 corrected(已纠错)
read_type读段类型:clr、ont、hifi
parallel_jobs并行任务数
workdir工作目录
input_fofn输入文件列表

纠错参数(Correction Options)

参数名含义
read_cutoff过滤低于此长度的读段
genome_size基因组大小估算
seed_depth期望的种子覆盖度(默认45)
blocksize并行拆分文件的最大尺寸(默认10g)
pa_correction并行纠错任务数(覆盖 parallel_jobs)
correction_options-p 线程数 等其他纠错参数

组装参数(Assembly Options)

参数名含义
minimap2_options_cns用于纠错读段之间的比对参数
nextgraph_options用于组装图构建的参数
04 引用

Hu J, Wang Z, Sun Z, et al. NextDenovo: an efficient error correction and accurate assembly tool for noisy long reads[J]. Genome Biology, 2024, 25(1): 1-19.

http://www.dtcms.com/wzjs/545060.html

相关文章:

  • 有链接的网站怎么做二手车网站怎么做的
  • h5模板下载有哪些网站网站开发浏览器不支持flash
  • 周浦网络网站建设公司seo提高网站排名
  • 百度网盘在线登录入口网站怎么做免费seo搜索
  • 上海营销型网站英文网站建设维护
  • 上海网站建设浦东wordpress读取速度慢
  • 什么网站可以赚钱啊八百客crm登录入口
  • 云南省保山建设网站网站排名查询alexa
  • 北京建站设计百度收录了我新网站的2篇文章了
  • 企业不想做网站的原因北京网站建设公司价格
  • 怎么做公司网站需要什么电子商务网站建设与管理的论文总结
  • 微营销工具网站面向哪些地区做优化容易
  • 云服务器可以建设个人网站吗wordpress themes
  • 石家庄网站seo外包企业网站asp源代码
  • 上海奉贤 网站建设阎良网站建设
  • 弹幕视频网站开发宁波网络公司网站建s
  • 百度喜欢什么样的网站seo少女
  • 湖南益阳网站建设电商平台推广
  • 贵金属企业网站源码定制型网站开发
  • 做儿童网站赚钱吗百度广告费一般多少钱
  • word做网站连接吉首网站建设
  • 手表网站代码工商网上注册
  • 网站前端怎么做北京南站
  • 铁岭网站建设 258魔站合肥公司建站模板
  • 山东美建站wordpress 用户函数
  • 做网站开发要学什么软件百度搜索排名与点击有关吗
  • 杭州网站制作公司用python做网站
  • 网站搜索量查询网站如何做业务
  • 做网络销售哪些网站比较好荆门网站建设公司
  • 四川省建设工程质量监理协会网站icp查询