登录注册写文章

TCGA基因ID的转换为基因symbol

TCGA基因ID的转换为基因symbol

#BiocManager::install("org.Hs.eg.db")
#1、TCGA基因ID的转换
library(stringr)
exp$Ensembl_ID <- rownames(exp)
exp$Ensembl_ID=str_sub(exp$Ensembl_ID,1,15)
library(clusterProfiler)
library(org.Hs.eg.db)
# 查看org.Hs.eg.db 包提供的转换类型
keytypes(org.Hs.eg.db)
# 需要转换的Ensembl_ID
Ensembl_ID <- exp$Ensembl_ID
# 采用bitr()函数进行转换
gene_symbol <- bitr(Ensembl_ID, fromType="ENSEMBL", toType=c("SYMBOL", "ENTREZID"), OrgDb="org.Hs.eg.db")
# 查看转换的结果
head(gene_symbol)

gene_symbol= gene_symbol[match(exp$Ensembl_ID,gene_symbol$ENSEMBL),]#匹配到表达矩阵中
exp$SYMBOL <- gene_symbol$SYMBOL
#整理去重，把重复的取平均值

exp <- exp[,-(ncol(exp)-1)]
exp2<-avereps(exp,ID=exp$SYMBOL)
exp2 <- as.data.frame(exp2)
exp2 <- exp2[!is.na(exp2$SYMBOL),]#去除没有匹配的
rownames(exp2) <- exp2$SYMBOL
exp <- exp2[,-ncol(exp2)]
```r

©著作权归作者所有,转载或内容合作请联系作者
平台声明：文章内容（如有图片或视频亦包括在内）由作者上传并发布，文章内容仅代表作者本人观点，简书系信息发布平台，仅提供信息存储服务。

推荐阅读更多精彩内容

番茄SL2.5 基因ID转换为Entrez ID
接着上一个帖子，在总结出我说可以通过爬虫获得两个基因命名规则匹配的文本文件，但是肥肥让我想到了一个办法可以在网站上...
不玩手机的蛇佬腔阅读 6,068评论 4赞 4
Transcript ID（ENST/ENSMUST/NM_123456）转换为gene ID...
----前不久拿到公司给的转录组测序结果，Gene ID是以ENMUST开头，查了一下，ENST为EMBL 核酸数...
佳名阅读 73,389评论 17赞 47
如何在R里面将Ensembl ID转换为Gene Symbol
下面以人类基因为例： library('biomaRt')mart <- useDataset("hsapiens...
台式计算机阅读 8,222评论 0赞 5
TCGA转录组差异分析后多种基因功能富集分析：从GO/KEGG到GSEA和GSVA/ssGSE...
测序上游分析系列： mRNA-seq转录组二代测序从raw reads到表达矩阵：上中游分析pipelinemiR...
ZZZZZZ_XX阅读 33,672评论 11赞 285
ID转换大全-3-使用R语言获取人类所有基因的名字，ID，symbol以及别名
使用R语言获取人类所有基因的名字，ID，symbol以及别名参考https://vip.biotrainee.c...
天涯清水阅读 6,132评论 0赞 5

7赞8赞

赞赏

手机看全文