下载已发表文章原始数据之SRA Toolkit(Fastq转换bam)

https://www.cnblogs.com/liujiaxin2018/p/15083885.html

1、下载进NCBI官网



2、



3、



4、根据系统选择版本,下载即可




5、查看自己系统

6、centos和redhed 使用软件一致

因此选择:



7、

[root@PC3 test]#wget https://ftp-trace.ncbi.nlm.nih.gov/sra/sdk/2.11.0/sratoolkit.2.11.0-centos_linux64.tar.gz

8、进度

9、

[root@PC3 test]# ls sratoolkit.2.11.0-centos_linux64.tar.gz

10、解压

[root@PC3 test]# tar -xzvf sratoolkit.2.11.0-centos_linux64.tar.gz

11、

[root@PC3 test]# ls

12、

[root@PC3 test]#cd sratoolkit.2.11.0-centos_linux64/

[root@PC3 sratoolkit.2.11.0-centos_linux64]# ls

[root@PC3 sratoolkit.2.11.0-centos_linux64]#cd bin

[root@PC3 bin]# ls

13、

[root@PC3 bin]#./fastq-dump

显示 This sra toolkit installation has not been configured.Before continuing, please run:vdb-config --interactiveFor more information, see https://www.ncbi.nlm.nih.gov/sra/docs/sra-cloud/


15、

[root@PC3 bin]#./vdb-config --interactive

16、直接输入f选择(默认)

17、输入y选择yes

18、输入o

19、输入x 离开

20、输入y保存修改

21、输入o即可

22、测试软件

[root@PC3 bin]#./fastq-dump

23、添加环境变量

[root@PC3 bin]#pwd/home/software/sratoolkit.2.11.0-centos_linux64/bin

24、  路径是上一条命令pwd输出的路径, 后面是追加>>,  千万不要写成重定向>.

[root@PC3 bin]# echo"export PATH=$PATH:/home/software/sratoolkit.2.11.0-centos_linux64/bin">>~/.bashrc

25、加载

[root@PC3 bin]#source ~/.bashrc

27、使用数据测试,下载好的两个样本的测试数据

fastq-dump -v --split-3 --gzip SRR3951713

使用NCBI提供的SRA-toolkit中的工具fastq-dump直接下载SRR文件,并转换为FASTQ格式,--split-3参数表示如果是双端测序就自动拆分,如果是单端不受影响。--gzip转换fastq为压缩文件,节省空间。

下载的数据集一般比较大,放入后台不中断下载 (nohup cmd &)。

比对到参考基因组输出bam文件

bwa进行索引构建

bwa index -a bwtsw -p hg19.fa hg19.fa

#1. 一个个比对,生成BAM文件,对质量好的测序数据进行比对

sample=SRR3951713

bwa mem -t 2 -R "@RG\tID:$sample\tSM:$sample\tLB:WGS\tPL:Illumina" /home/ug0439/zjs/ref/ref-hg19/ SRR3951713_1.fastq.gz SRR3951713_2.fastq.gz |samtools sort -@ 2 -o SRR3951713.bam -

##=========增加第一列文件名,记得不能空格,要Tab分隔如果样本量很多就用脚本,具体见大样本分析那篇align目录下

##==========查看bam文件

$ samtools view -H SRR3951713.bam |grep -v "SQ"

##==========将bam文件转换为bed文件===============

bedtools bamtobed -i SRR3951713.bam > SRR3951713.bed

最后编辑于
©著作权归作者所有,转载或内容合作请联系作者
  • 序言:七十年代末,一起剥皮案震惊了整个滨河市,随后出现的几起案子,更是在滨河造成了极大的恐慌,老刑警刘岩,带你破解...
    沈念sama阅读 215,076评论 6 497
  • 序言:滨河连续发生了三起死亡事件,死亡现场离奇诡异,居然都是意外死亡,警方通过查阅死者的电脑和手机,发现死者居然都...
    沈念sama阅读 91,658评论 3 389
  • 文/潘晓璐 我一进店门,熙熙楼的掌柜王于贵愁眉苦脸地迎上来,“玉大人,你说我怎么就摊上这事。” “怎么了?”我有些...
    开封第一讲书人阅读 160,732评论 0 350
  • 文/不坏的土叔 我叫张陵,是天一观的道长。 经常有香客问我,道长,这世上最难降的妖魔是什么? 我笑而不...
    开封第一讲书人阅读 57,493评论 1 288
  • 正文 为了忘掉前任,我火速办了婚礼,结果婚礼上,老公的妹妹穿的比我还像新娘。我一直安慰自己,他们只是感情好,可当我...
    茶点故事阅读 66,591评论 6 386
  • 文/花漫 我一把揭开白布。 她就那样静静地躺着,像睡着了一般。 火红的嫁衣衬着肌肤如雪。 梳的纹丝不乱的头发上,一...
    开封第一讲书人阅读 50,598评论 1 293
  • 那天,我揣着相机与录音,去河边找鬼。 笑死,一个胖子当着我的面吹牛,可吹牛的内容都是我干的。 我是一名探鬼主播,决...
    沈念sama阅读 39,601评论 3 415
  • 文/苍兰香墨 我猛地睁开眼,长吁一口气:“原来是场噩梦啊……” “哼!你这毒妇竟也来了?” 一声冷哼从身侧响起,我...
    开封第一讲书人阅读 38,348评论 0 270
  • 序言:老挝万荣一对情侣失踪,失踪者是张志新(化名)和其女友刘颖,没想到半个月后,有当地人在树林里发现了一具尸体,经...
    沈念sama阅读 44,797评论 1 307
  • 正文 独居荒郊野岭守林人离奇死亡,尸身上长有42处带血的脓包…… 初始之章·张勋 以下内容为张勋视角 年9月15日...
    茶点故事阅读 37,114评论 2 330
  • 正文 我和宋清朗相恋三年,在试婚纱的时候发现自己被绿了。 大学时的朋友给我发了我未婚夫和他白月光在一起吃饭的照片。...
    茶点故事阅读 39,278评论 1 344
  • 序言:一个原本活蹦乱跳的男人离奇死亡,死状恐怖,灵堂内的尸体忽然破棺而出,到底是诈尸还是另有隐情,我是刑警宁泽,带...
    沈念sama阅读 34,953评论 5 339
  • 正文 年R本政府宣布,位于F岛的核电站,受9级特大地震影响,放射性物质发生泄漏。R本人自食恶果不足惜,却给世界环境...
    茶点故事阅读 40,585评论 3 322
  • 文/蒙蒙 一、第九天 我趴在偏房一处隐蔽的房顶上张望。 院中可真热闹,春花似锦、人声如沸。这庄子的主人今日做“春日...
    开封第一讲书人阅读 31,202评论 0 21
  • 文/苍兰香墨 我抬头看了看天上的太阳。三九已至,却和暖如春,着一层夹袄步出监牢的瞬间,已是汗流浃背。 一阵脚步声响...
    开封第一讲书人阅读 32,442评论 1 268
  • 我被黑心中介骗来泰国打工, 没想到刚下飞机就差点儿被人妖公主榨干…… 1. 我叫王不留,地道东北人。 一个月前我还...
    沈念sama阅读 47,180评论 2 367
  • 正文 我出身青楼,却偏偏与公主长得像,于是被迫代替她去往敌国和亲。 传闻我的和亲对象是个残疾皇子,可洞房花烛夜当晚...
    茶点故事阅读 44,139评论 2 352

推荐阅读更多精彩内容