bin

for i in *_clean_R1.fq.gz;

do base=$(basename $i _clean_R1.fq.gz);

echo $base;

concatenate.py ../bin/$base/${base}_catalogue.fna ../3_assembly/${base}_contig.fa --nozip -m 1500;

/home/roo/biosoft/minimap2-2.17_x64-linux/minimap2 -d ../bin/$base/${base}_catalogue.mmi ../bin/$base/${base}_catalogue.fna;

/home/roo/biosoft/minimap2-2.17_x64-linux/minimap2 -t 32 -N 50 -ax sr ../bin/$base/${base}_catalogue.mmi ${base}_clean_R1.fq.gz ${base}_clean_R2.fq.gz | samtools view -F 3584 -b --threads 32 > ../bin/$base/${base}.bam;

samtools sort -@ 32 -l 9 ../bin/$base/${base}.bam -o ../bin/$base/${base}.sort.bam;

jgi_summarize_bam_contig_depths --outputDepth ../bin/$base/${base}.depth.txt ../bin/$base/${base}.sort.bam;

metabat2 -m 1500 -t 32 -i ../bin/$base/${base}_catalogue.fna -a ../bin/$base/${base}.depth.txt -o ../bin/$base/all -v;

done

for i in *_clean_R1.fq.gz;

do base=$(basename $i _clean_R1.fq.gz);

echo $base;

dRep dereplicate ../bin/$base/derep -g ../bin/$base/*.fa -sa 0.95 -nc 0.30 -p 12 -comp 50 -con 10;

checkm lineage_wf -x fa ../bin/$base/derep/dereplicated_genomes ../bin/$base/derep/checkm_out -t 12;

done

wget http://eddylab.org/software/hmmer3/3.1b2/hmmer-3.1b2-linux-intel-x86_64.tar.gz

tar -zxvf hmmer-3.1b2-linux-intel-x86_64.tar.gz

cd /home/roo/biosoft/hmmsearch/hmmer-3.1b2-linux-intel-x86_64/

sudo vim ./configure

PATH=$PATH:/home/roo/biosoft/hmmsearch/hmmer-3.1b2-linux-intel-x86_64/binaries

source .configure

for i in *_clean_R1.fq.gz;

do base=$(basename $i _clean_R1.fq.gz);

echo $base;

cut_up_fasta.py ../../bin/$base/${base}_catalogue.fna -c 10000 -o 0 --merge_last -b ../../bin/$base/contigs_10K.bed > ../../bin/$base/contigs_10K.fa;

concoct_coverage_table.py ../../bin/$base/contigs_10K.bed ../../bin/$base/${base}.sort.bam > ../../bin/$base/coverage_table.tsv;

concoct -t 32 --composition_file ../../bin/$base/contigs_10K.fa --coverage_file ../../bin/$base/coverage_table.tsv -b ../../bin/$base/concoct_output/;

merge_cutup_clustering.py ../../bin/$base/concoct_output/clustering_gt1000.csv > ../../bin/$base/concoct_output/clustering_merged.csv;

mkdir ../../bin/$base/concoct_output/fasta_bins;

extract_fasta_bins.py ../../bin/$base/${base}_catalogue.fna ../../bin/$base/concoct_output/clustering_merged.csv --output_path ../../bin/$base/concoct_output/fasta_bins;

done

最后编辑于 :
©著作权归作者所有,转载或内容合作请联系作者
【社区内容提示】社区部分内容疑似由AI辅助生成,浏览时请结合常识与多方信息审慎甄别。
平台声明:文章内容(如有图片或视频亦包括在内)由作者上传并发布,文章内容仅代表作者本人观点,简书系信息发布平台,仅提供信息存储服务。

相关阅读更多精彩内容

  • 三代测序数据简单分析 原创 saber universebiologygirl 简单介绍: 三代测序技术读长较长,...
    天明豆豆阅读 11,172评论 1赞 17
  • 首先要感谢特别特别好说话的师姐和同门的帮助和交流,主要用到的工具是linux和NCBI 然后在整个过程中也借鉴了j...
    曹草BioInfo阅读 1,181评论 2赞 4
  • 导读 分箱就是将宏基因组测序数据组装得到的contigs根据四核苷酸频率和丰度模式进行打包分类的过程,一个包裹也就...
    胡童远阅读 4,711评论 1赞 7
  • Introduction What is Bowtie 2? Bowtie 2 is an ultrafast a...
    wzz阅读 6,406评论 0赞 5
  • 基因组重测序数据目的:需要检测基因组中的变异,找到并定位这些突变位点 条件:参考基因组、重测序数据、 分析流程: ...
    古月福_阅读 3,161评论 1赞 2

友情链接更多精彩内容