DNA甲基化数据分析(一)

Hi,大家好。最近在帮师姐分析甲基化,顺便就把甲基化分析过程整理一下。
我们先来看看什么是DNA甲基化。
DNA甲基化(DNA methylation)为DNA化学修饰的一种形式,能够在不改变DNA序列的前提下,改变遗传表现。所谓DNA甲基化是指在DNA甲基化转移酶的作用下,在基因组CpG二核苷酸的胞嘧啶5号碳位共价键结合一个甲基基团。大量研究表明,DNA甲基化能引起染色质结构、DNA构象、DNA稳定性及DNA与蛋白质相互作用方式的改变,从而控制基因表达[2]。
在成熟体细胞组织中,DNA甲基化一般发生于CpG双核苷酸(CpG dinucleotide)部位;而非CpG甲基化则于胚胎干细胞中较为常见[1,2]。植物体内胞嘧啶的甲基化则可分为对称的CpG(或CpNpG),或是不对称的CpNpNp形式(C与G是碱基;p是磷酸根;N指的是任意的核苷酸)。DNA甲基化可以理解为基因组上的表观修饰,也就是说甲基化可以导致基因失活,去甲基化则代表基因的激活与表达。

从公司拿到DNA甲基化测序数据后,我们就可以进行DNA甲基化分析了。

DNA甲基化数据处理所使用的软件为Bismark(https://www.bioinformatics.babraham.ac.uk/projects/bismark/).

依赖软件
需要用户提前安装好Bowtie2(http://bowtie-bio.sourceforge.net/bowtie2/index.shtml)和Hisat2(https://ccb.jhu.edu/software/hisat2/index.shtml),bam文件输出需要提前安装Samtools(http://samtools.sourceforge.net/)

一、下载软件
我们可以从官网直接下载,也可以从GitHut(https://github.com/FelixKrueger/Bismark)下载

image.png

下载好,进入Bismark

git clone https://github.com/FelixKrueger/Bismark.git
cd Bismark 
./bismark_genome_preparation –version
image.png

接下来分析,我们使用软件中的示例文件,在travis_files文件中

cd travis_files
ls 
image.png

二、对基因组构建索引

/bismark/bismark_genome_preparation --path_to_aligner /usr/bin/bowtie2/ --verbose /data/travis_files

结果生成Bisulfite_Genome文件夹,使用tree命令查看文件夹下都有什么文件


image.png

三、运行bismark, 进行比对
对于双端测序

bismark --genome ./travis_files/ -1 ./travis_files/test_R1.fastq.gz -2 ./travis_files/test_R2.fastq.gz -p 2 -o ./results/

这里将输出两个文件:

  1. test_R1_bismark_bt2_pe.bam (contains all alignments plus methylation call strings)
  2. test_R1_bismark_bt2_PE_report.txt (contains alignment and methylation summary)

四、删除重复数据

./deduplicate_bismark --bam ./results/test_R1_bismark_bt2_pe.bam --output_dir ./results/

五、提取甲基化位点

./bismark_methylation_extractor -p --gzip --bedGraph --buffer_size 10G --cytosine_report --comprehensive --genome_folder ./travis_files/ ./results/test_R1_bismark_bt2_pe.bam -o ./results/

--cytosine_report生成基因组中所有cytosine的全基因组甲基化报告。
--comprehensive会合并正反链的数据,输出CpG/CHG/CHH三种类型的甲基化文件,包含了胞嘧啶所有的组合形式,但我们最关注的是CpG位点的甲基化。


image.png

六、生成处理报告和总结报告
./bismark2report
./bismark2summary

结果解析
bismark2report此脚本使用Bismark比对报告来生成图形HTML报告页。
即test_R1_bismark_bt2_PE_report.html, 它包括了比对信息,甲基化信息,M-bias等,我们可以简单看一下


image.png

image.png

image.png

image.png

image.png

image.png

image.png

前面已经提到使用--comprehensive,会输出CpG/CHG/CHH三种类型的甲基化文件,其中CpG_context_test_R1_bismark_bt2_pe.txt.gz即为CpG甲基化位点的文件。

less CpG_context_test_R1_bismark_bt2_pe.txt.gz
image.png

文件中每一列含义
第一列是测序信息
第二列为甲基化状态,+为甲基化,-为为甲基化
第三列为染色体
第四列为起始位置(等于终止位置)
第五列为methylation call strings, 即大写就是甲基化

  • z - C in CpG context - unmethylated
  • Z - C in CpG context - methylated
  • x - C in CHG context - unmethylated
  • X - C in CHG context - methylated
  • h - C in CHH context - unmethylated
  • H - C in CHH context - methylated
  • u - C in Unknown context (CN or CHN) - unmethylated
  • U - C in Unknown context (CN or CHN) - methylated
  • . - not a C or irrelevant position

test_R1_bismark_bt2_pe.bismark.cov.gz提供了每个位点的甲基化比例

less test_R1_bismark_bt2_pe.bismark.cov.gz
image.png

第一列为染色体
第二列为起始位置
第三列为终止位置
第四列为甲基化比例
第五列为甲基化个数
第六列为未甲基化个数

如何你还有其他问题,可以直接看软件里面README.md,也可以咨询我。

参考:
1.Dodge, Jonathan E.; Bernard H. Ramsahoyeb, Z. Galen Woa, Masaki Okanoa, En Li. De novo methylation of MMLV provirus in embryonic stem cells: CpG versus non-CpG methylation. Science Direct. May 2002 [2007-06-23].
2.百度百科

  1. DNA甲基化测序数据处理(一):数据比对https://www.jianshu.com/p/5d7e550abc1a?from=singlemessage
©著作权归作者所有,转载或内容合作请联系作者
  • 序言:七十年代末,一起剥皮案震惊了整个滨河市,随后出现的几起案子,更是在滨河造成了极大的恐慌,老刑警刘岩,带你破解...
    沈念sama阅读 216,324评论 6 498
  • 序言:滨河连续发生了三起死亡事件,死亡现场离奇诡异,居然都是意外死亡,警方通过查阅死者的电脑和手机,发现死者居然都...
    沈念sama阅读 92,356评论 3 392
  • 文/潘晓璐 我一进店门,熙熙楼的掌柜王于贵愁眉苦脸地迎上来,“玉大人,你说我怎么就摊上这事。” “怎么了?”我有些...
    开封第一讲书人阅读 162,328评论 0 353
  • 文/不坏的土叔 我叫张陵,是天一观的道长。 经常有香客问我,道长,这世上最难降的妖魔是什么? 我笑而不...
    开封第一讲书人阅读 58,147评论 1 292
  • 正文 为了忘掉前任,我火速办了婚礼,结果婚礼上,老公的妹妹穿的比我还像新娘。我一直安慰自己,他们只是感情好,可当我...
    茶点故事阅读 67,160评论 6 388
  • 文/花漫 我一把揭开白布。 她就那样静静地躺着,像睡着了一般。 火红的嫁衣衬着肌肤如雪。 梳的纹丝不乱的头发上,一...
    开封第一讲书人阅读 51,115评论 1 296
  • 那天,我揣着相机与录音,去河边找鬼。 笑死,一个胖子当着我的面吹牛,可吹牛的内容都是我干的。 我是一名探鬼主播,决...
    沈念sama阅读 40,025评论 3 417
  • 文/苍兰香墨 我猛地睁开眼,长吁一口气:“原来是场噩梦啊……” “哼!你这毒妇竟也来了?” 一声冷哼从身侧响起,我...
    开封第一讲书人阅读 38,867评论 0 274
  • 序言:老挝万荣一对情侣失踪,失踪者是张志新(化名)和其女友刘颖,没想到半个月后,有当地人在树林里发现了一具尸体,经...
    沈念sama阅读 45,307评论 1 310
  • 正文 独居荒郊野岭守林人离奇死亡,尸身上长有42处带血的脓包…… 初始之章·张勋 以下内容为张勋视角 年9月15日...
    茶点故事阅读 37,528评论 2 332
  • 正文 我和宋清朗相恋三年,在试婚纱的时候发现自己被绿了。 大学时的朋友给我发了我未婚夫和他白月光在一起吃饭的照片。...
    茶点故事阅读 39,688评论 1 348
  • 序言:一个原本活蹦乱跳的男人离奇死亡,死状恐怖,灵堂内的尸体忽然破棺而出,到底是诈尸还是另有隐情,我是刑警宁泽,带...
    沈念sama阅读 35,409评论 5 343
  • 正文 年R本政府宣布,位于F岛的核电站,受9级特大地震影响,放射性物质发生泄漏。R本人自食恶果不足惜,却给世界环境...
    茶点故事阅读 41,001评论 3 325
  • 文/蒙蒙 一、第九天 我趴在偏房一处隐蔽的房顶上张望。 院中可真热闹,春花似锦、人声如沸。这庄子的主人今日做“春日...
    开封第一讲书人阅读 31,657评论 0 22
  • 文/苍兰香墨 我抬头看了看天上的太阳。三九已至,却和暖如春,着一层夹袄步出监牢的瞬间,已是汗流浃背。 一阵脚步声响...
    开封第一讲书人阅读 32,811评论 1 268
  • 我被黑心中介骗来泰国打工, 没想到刚下飞机就差点儿被人妖公主榨干…… 1. 我叫王不留,地道东北人。 一个月前我还...
    沈念sama阅读 47,685评论 2 368
  • 正文 我出身青楼,却偏偏与公主长得像,于是被迫代替她去往敌国和亲。 传闻我的和亲对象是个残疾皇子,可洞房花烛夜当晚...
    茶点故事阅读 44,573评论 2 353

推荐阅读更多精彩内容