10月 13

白大褂是防护服不是外套

以前在瑞金医院的时候,经常看到一堆人穿着白大褂听报告、排队买饭。最近,在天津医科大学的食堂里,看到有部分学生穿着白大褂吃饭。白大褂很白,但它干净吗?

每个第一次近实验室的同学都会被告知要穿着白大褂做实验,但有多少人想过为什么要这样呢?其实,道理很简单,实验室物品、试剂繁杂,有的有一定的危害性,穿上白大褂可以起到防护作用。试剂溅出或者物品粘粘的话,不会直接到达衣服或者皮肤上,只会到达起防护作用的白大褂上。由此,不难想见,白大褂虽然看起来很白,但实际上非常“脏”!

有鉴于此,请广大实验人员及学生不要穿着白大褂在实验室以外的区域走动,更不要以白大褂当作外套到生活区,如:参加报告会、去食堂就餐,等。

因为本人从事生物信息学工作,已有多年不进实验室、不穿白大褂。此文如有讹误,敬请指正!
Continue reading

10月 13

LaTeX文档的自动编译与实时预览

管理LaTeX源代码文档,最开始的时候,我是在终端中手动输入编译命令,每次都需要输入好几次命令才能得到最终的文档。之后,为了简化操作,自习了Makefile,使用make来编译、预览LaTeX文档,效率大大提高,但每次都要适当修改Makefile,仍有一定的繁琐。今天,偶然发现一个编译、预览LaTeX文档的利器——latexmk,强烈推荐给使用LaTeX制作文档的朋友们。此处对于使用make和latexmk编译预览LaTeX文档分别做一个简要的介绍。……【阅读全文】

10月 13

人类基因组中的基因密度、特征长度和SNP密度

一、源起

本周,在为本科生设计生物信息学实验的时候,突发奇想,想要利用Galaxy工具计算一下人类基因组的常识性信息,如:每条染色体上的基因密度,外显子、内含子等特征(feature)的平均长度,SNP在UTR、编码区、内含子等不同特征区域的密度。

二、工具

系统平台:Linux(Ubuntu 12.04,AMD64)。
UCSC Table:下载基因组数据至本地。
Galaxy:用于在线处理基因组数据。
BEDTools(v2.16.2):用于本地处理基因组数据
R(v2.15.1):绘制图表。
其他:Vim(v7.3.429)。

三、数据库

human genome:hg19
dbSNP:135

四、结果

1.基因在每条染色体上的数目与密度。

  • 数据表格
chromosomelength.bplength.100kbgeneNumbergeneDensity.numberPer100Mb
chr12492506212492.5062141771675.82330718
chr22431993732431.9937325631053.86784858
chr31980224301980.224322511136.73991376
chr41911542761911.542761592832.835149343
chr51809152601809.15261739961.223503203
chr61711150671711.1506720711210.29669468
chr71591386631591.3866319401219.06264853
chrX1552705601552.705620831341.5292635
chr81463640221463.640221437981.79865541
chr91412134311412.1343115731113.91670669
chr101355347471355.3474717491290.4439922
chr111350065161350.0651624851840.65189861
chr121338518951338.5189521021570.39241021
chr131151698781151.69878711617.348921738
chr141073495401073.495413341242.66950748
chr151025313921025.3139213571323.49710028
chr1690354753903.5475316001770.79782399
chr1781195210811.952123312870.85900757
chr1878077248780.77248599767.188925511
chr2063025520630.255211671851.63089491
chrY59373566593.73566347584.435167664
chr1959128983591.2898327164593.34807095
chr2251304566513.045669241801.00929028
chr2148129895481.298955341109.49753786

 

  • 条形图展示

基因在每条染色体上的数目与密度
Continue reading

10月 13

关于EMBOSS和Galaxy的生物信息学实验课程设计

本人设计的针对本科生的生物信息学实验课程设计,包括涉及EMBOSS和Galaxy的三个题目:

  • 基于 EMBOSS 平台对 *** 基因进行序列分析
  • 基于 Galaxy 平台分析 *** 物种基因在基因组中的分布
  • 基于 Galaxy 平台分析 *** 物种 SNP 在不同特征区域中的分布

对于每一个题目,我都记录了详细的操作步骤,对于想学习EMBOSS和Galaxy(主要是后者)的朋友可能会有所帮助。
Continue reading