PacBio-BioNano-Genome数据上传NCBI经历

栏目: 编程语言 · 发布时间: 6年前

内容简介:进入根据介绍可选择文件类型为:CMAP,COORD (混合组装过程),XMAP,SMAP (结构变异数据) 和下机数据BNX;

PacBio-BioNano-Genome数据上传NCBI经历

1. PacBio原始下机bam格式数据上传

自PacBio Sequel平台开始,PacBio原始下机数据均为bam格式,该如何上传NCBI呢?

PacBio-BioNano-Genome数据上传NCBI经历

NCBI的 SRA_metadata_acc.xlsx 文件提供PacBio格式为PacBio RS平台的HDF5格式,而第一个bam格式则认为是比对结果文件,需要在assembly列提供比对基因组信息;

PacBio-BioNano-Genome数据上传NCBI经历

这该如何是好?万能的NCBI工作人员给我们支招了:point_down:

For unaligned bam files please enter unaligned in the assembly column.

2. BioNano数据上传

进入 Supplementary Files ,选择BioNano原始Map数据或混合组装 (hybrid assembly) 过程数据上传;

根据介绍可选择文件类型为:CMAP,COORD (混合组装过程),XMAP,SMAP (结构变异数据) 和下机数据BNX;

3. 基因组数据上传

Denovo组装基因组上传时通常需上传测序相关原始数据,首先参考 测序数据上传NCBI总结 提交专门上传基因组测序原始数据的BioProject和BioSample;

准备基因组 fa(未注释基因组)/sqn(已注释基因组)

格式文件,进入

Genome

上传;

准备数据清单

  • 基因组fa/sqn文件
  • BioProject 号
  • BioSample 号
  • WGS 或 non-wgs genome
    PacBio-BioNano-Genome数据上传NCBI经历
  • AGP 文件,可通过 AGP validation on-line 进行文件格式确认或者 下载软件 在命令行确认 ( fatoagp 可根据fa文件生成AGP文件; fasta2apg.pl 根据fa文件生成AGP文件且输出分隔的contig.fa和scaffold.fa)
  • 其他可选注释信息

以上就是本文的全部内容,希望本文的内容对大家的学习或者工作能带来一定的帮助,也希望大家多多支持 码农网

查看所有标签

猜你喜欢:

本站部分资源来源于网络,本站转载出于传递更多信息之目的,版权归原作者或者来源机构所有,如转载稿涉及版权问题,请联系我们

共享经济

共享经济

[美] 罗宾•蔡斯 / 王芮 / 浙江人民出版社 / 2015-9-25 / 59.90元

[内容简介]  在当今这个稀缺的世界里,人人共享组织可以创造出富足。通过利用已有的资源,如有形资产、技术、网络、设备、数据、经验和流程等,这些组织可以以指数级成长。人人共享重新定义了我们对于资产的理解:它是专属于个人的还是大众的;是私有的还是公有的;是商业的还是个人的,并且也让我们对监管、保险以及管理有了重新的思索。  在这本书中,罗宾与大家分享了以下观点:  如何利用过剩......一起来看看 《共享经济》 这本书的介绍吧!

URL 编码/解码
URL 编码/解码

URL 编码/解码

HSV CMYK 转换工具
HSV CMYK 转换工具

HSV CMYK互换工具