可视化生信分析利器-Galaxy(第一讲)

什么是Galaxy

很多公司开始推广他们的可视化生信分析工具,有人说未来的趋势是无代码,分析只要拖拖点点就行了。无代码只能说是一个噱头,毕竟人人都会“用"excel,也不是人人都是数据分析师。

但是一个数据分析师肯定知道如何正确的使用excel,所以一个真正的生信媛/猿也不会嫌弃那些可视化的工具。毕竟写代码累了,没事拖拖点点也是别样的乐趣。

Galaxy就是很多年前在云计算背景下诞生的开源项目, 目前在GitHub上有362个star,165个贡献者。

官方站点: https://usegalaxy.org/,如果感兴趣的话可以在云端玩耍下。

Galaxy

然后,将有一波galaxy学习笔记更新而来。

安装

在正式安装之前,确保自己使用的是Unix/Linux系统,并且安装了Python,且版本是2.7.(最好还有Git)。

galaxy的安装非常简单,就是从github上克隆一份到本地,然后运行部署脚本,然后等着。

# 我习惯把软件安装在biosoft下
cd ~/biosoft
# 克隆到本地
git clone -b release_17.09 https://github.com/galaxyproject/galaxy.git
cd galaxy
# 修改配置文件
cp config/galaxy.ini.sample config/galaxy.ini
# The port on which to listen.
port = 1024
# The address on which to listen.  By default, only listen to localhost (Galaxy
# will not be accessible over the network).  Use '0.0.0.0' to listen on all
# available network interfaces.
host = 0.0.0.0
# 运行
sh run.sh

我这里简单的修改了配置文件, 使其可以被内网的其他用户通过“IP:1024"的方式访问。

image

配置

管理员账号

Galaxy后续如果要进行软件安装,管理用户等操作,就必须要先要成为管理员。

第一步: 在galaxy进行注册

image

第二步: 修改配置文件config/galaxy.ini,更改其中的admin_users.

# this should be a comma-separated list of valid Galaxy users
admin_users = user1@example.com,user2@example.com

第三步: 重启run.sh或者重新登陆账号,就会发现在工作栏上多了Admin这一部分。

安装软件

安装工具OR下载数据有三种方法:

  • 从Tool Shed安装
  • 手动添加到Galaxy中
  • 脚本自动化完成

其中从Tool shed安装最方便,官方教程介绍的非常详细,跟从APP Store下载软件没有啥太大区别。

如下演示BWA软件如何安装。

image

小技巧: galaxy同样利用bioconda进行生信软件管理,因此修改galaxy/config/galaxy.ini中如下行

# conda_ensure_channels = iuc,bioconda,conda-forge,defaults,r
conda_ensure_channels = iuc,https://mirrors.tuna.tsinghua.edu.cn/anaconda/cloud/bioconda/,https://mirrors.tuna.tsinghua.edu.cn/anaconda/cloud/conda-forge/,defaults,r

这行代码仅针对国内用户,感谢清华镜像源。

可视化数据管理

数据管理是一件非常琐碎,非常基础,但是却非常重要的事情。你不能直接把数据丢在一边,假装他已经被你整理了。你必须面对这只”灰犀牛“,知道如何正确的对数据进行管理。

生信分析的数据可以分为以下几类:

  • 参考序列,注释文件,索引文件
  • 用户上传数据
  • 分析过程中所产生的数据

Galaxy建立了专门的数据管理体系,用于记录这几类数据,便于不同工具间的交互。

Part I:准备参考基因序列并建立索引。

和这部分相关的工具位于Data ManagersData source两个工具分类下。

image

这一部分需要安装的工具如下,请参考安装软件一节完成安装。

  • data_manager_fetch_genome_dbkeys_all_fasta
  • data_manager_bwa_mem_index_builde
  • data_manager_bowtie2_index_builder
  • data_manager_fetch_gene_annotation
  • data_manager_hisat2_index_builder

安装完成之后,点击adminlocal data会出现如下内容。

image

hu

拟南芥为例, 我事先在TAIR上复制了其参考基因组的下载地址, 随后在adminlocal data中选择"ata_manager_fetch_genome_dbkeys_all_fasta"进行下载。

image

hua

随后就能在如下的"Data Manager Jobs"查看运行进程。

image

不难发现,其实我也是在2次失败的尝试后,才找到的正确地使用方式。但是由于我重复添加同一个物种,结果后面各种报错,于是我就只能使用了最后的绝招--重装Galaxy。

后续需要对参考基因组建立索引,过程和上面的一致,只不过你需要选择BWA-MEM index,之后就是点点然后等几分钟就行了。

如果是人类的参考基因组,可以考虑下载已有的索引,然后修改galaxy的配置文件。

Part II: 用户上传数据

用户上传数据这一块比较简单,如下图选择Upload File, 然后从本地选择需要的数据进行上传即可。

image

Part III: 中间数据。 这个部分目前不需要担心,你可以将分析结果下载到本地,然后在本地用IGV进行查看。这个部分在workflow会继续再介绍。

image

下一讲

如何自动化安装软件?如何配置galaxy项目还没有的工具?大规模数据应该如何上传?

这些内容见下一讲吧。

最后编辑于
©著作权归作者所有,转载或内容合作请联系作者
  • 序言:七十年代末,一起剥皮案震惊了整个滨河市,随后出现的几起案子,更是在滨河造成了极大的恐慌,老刑警刘岩,带你破解...
    沈念sama阅读 204,053评论 6 478
  • 序言:滨河连续发生了三起死亡事件,死亡现场离奇诡异,居然都是意外死亡,警方通过查阅死者的电脑和手机,发现死者居然都...
    沈念sama阅读 85,527评论 2 381
  • 文/潘晓璐 我一进店门,熙熙楼的掌柜王于贵愁眉苦脸地迎上来,“玉大人,你说我怎么就摊上这事。” “怎么了?”我有些...
    开封第一讲书人阅读 150,779评论 0 337
  • 文/不坏的土叔 我叫张陵,是天一观的道长。 经常有香客问我,道长,这世上最难降的妖魔是什么? 我笑而不...
    开封第一讲书人阅读 54,685评论 1 276
  • 正文 为了忘掉前任,我火速办了婚礼,结果婚礼上,老公的妹妹穿的比我还像新娘。我一直安慰自己,他们只是感情好,可当我...
    茶点故事阅读 63,699评论 5 366
  • 文/花漫 我一把揭开白布。 她就那样静静地躺着,像睡着了一般。 火红的嫁衣衬着肌肤如雪。 梳的纹丝不乱的头发上,一...
    开封第一讲书人阅读 48,609评论 1 281
  • 那天,我揣着相机与录音,去河边找鬼。 笑死,一个胖子当着我的面吹牛,可吹牛的内容都是我干的。 我是一名探鬼主播,决...
    沈念sama阅读 37,989评论 3 396
  • 文/苍兰香墨 我猛地睁开眼,长吁一口气:“原来是场噩梦啊……” “哼!你这毒妇竟也来了?” 一声冷哼从身侧响起,我...
    开封第一讲书人阅读 36,654评论 0 258
  • 序言:老挝万荣一对情侣失踪,失踪者是张志新(化名)和其女友刘颖,没想到半个月后,有当地人在树林里发现了一具尸体,经...
    沈念sama阅读 40,890评论 1 298
  • 正文 独居荒郊野岭守林人离奇死亡,尸身上长有42处带血的脓包…… 初始之章·张勋 以下内容为张勋视角 年9月15日...
    茶点故事阅读 35,634评论 2 321
  • 正文 我和宋清朗相恋三年,在试婚纱的时候发现自己被绿了。 大学时的朋友给我发了我未婚夫和他白月光在一起吃饭的照片。...
    茶点故事阅读 37,716评论 1 330
  • 序言:一个原本活蹦乱跳的男人离奇死亡,死状恐怖,灵堂内的尸体忽然破棺而出,到底是诈尸还是另有隐情,我是刑警宁泽,带...
    沈念sama阅读 33,394评论 4 319
  • 正文 年R本政府宣布,位于F岛的核电站,受9级特大地震影响,放射性物质发生泄漏。R本人自食恶果不足惜,却给世界环境...
    茶点故事阅读 38,976评论 3 307
  • 文/蒙蒙 一、第九天 我趴在偏房一处隐蔽的房顶上张望。 院中可真热闹,春花似锦、人声如沸。这庄子的主人今日做“春日...
    开封第一讲书人阅读 29,950评论 0 19
  • 文/苍兰香墨 我抬头看了看天上的太阳。三九已至,却和暖如春,着一层夹袄步出监牢的瞬间,已是汗流浃背。 一阵脚步声响...
    开封第一讲书人阅读 31,191评论 1 260
  • 我被黑心中介骗来泰国打工, 没想到刚下飞机就差点儿被人妖公主榨干…… 1. 我叫王不留,地道东北人。 一个月前我还...
    沈念sama阅读 44,849评论 2 349
  • 正文 我出身青楼,却偏偏与公主长得像,于是被迫代替她去往敌国和亲。 传闻我的和亲对象是个残疾皇子,可洞房花烛夜当晚...
    茶点故事阅读 42,458评论 2 342

推荐阅读更多精彩内容