【生信笔记】Emsenbl的BioMart工具:对RNA进行多种ID批量转换

2023-10-12 13:30

本文主要是介绍【生信笔记】Emsenbl的BioMart工具:对RNA进行多种ID批量转换,希望对大家解决编程问题提供一定的参考价值,需要的开发者们随着小编来一起学习吧!

大家好我是lotusng,本期blog我跟大家分享一个RNA的ID转换方法:利用Emsenbl的BioMart工具。

众所周知(?),Emsenbl网站提供了多种物种的多种DNA与RNA的序列等信息,其实Emsenbl还有一个功能很强大的RNA 在线ID转换工具BioMart,我来安利一下~

Emsenbl的BioMart工具: http://asia.ensembl.org/biomart/martview/db73e9d48b0fb03717654a65c72012c4


文章目录

    • 0 数据输入格式与输出要求
    • 1 选择人类基因数据库
        • (1)-> Emsenbl
        • (2)-> 点BioMart
        • (3)-> 点Dataset
        • (4)-> 选择输入的基因来自什么库
    • 2 输入的ID列表
        • (1)-> 点Fliters(过滤器)
        • (2)-> 勾选Input ereferences ID list
        • (3)-> 选择输入的基因ID类别
        • (4) 文本框内输入Gene Name列表
    • 3 输出的属性选项
        • (1)-> Attributes(属性)
        • (2)-> GENE -> Ensembl 选择输出格式
        • (3)-> External References
    • 4 结果的输出及下载保存
        • (1)-> (网页左上角)点Results
        • (2)-> 下载格式选 XLS
        • (3)-> GO
    • 下面开始BioMart的技术总结
    • 附 Excel分列小技巧


0 数据输入格式与输出要求

 首先,看一下我们的例子,我们的数据是人类的miRNA的Gene name,目的是转换得到 Gene ID、Transcript ID、miRBase ID


1 选择人类基因数据库

(1)-> Emsenbl

  Emsenbl 网址:http://asia.ensembl.org/index.html

(2)-> 点BioMart
(3)-> 点Dataset
(4)-> 选择输入的基因来自什么库

 人类基因选择:选择 Ensembl Genes 92Human genes(GRCh38.p12) (注:目前最新的选项更新为Ensembl Genes 95,选它)

在这里插入图片描述


2 输入的ID列表

(1)-> 点Fliters(过滤器)
(2)-> 勾选Input ereferences ID list
(3)-> 选择输入的基因ID类别

  我们的数据是miRNA的Gene Name,如图选Gene Name(s)

(4) 文本框内输入Gene Name列表

在这里插入图片描述

  如果数据是Gene ID:ENSG12345678910这样的,选Gene stable ID(s)。以此类推。
  根据自己数据的类型,选择对应的ID格式。(注意看选项后括号里给出的例子,要和自己的数据完全对应上)
在这里插入图片描述

3 输出的属性选项

(1)-> Attributes(属性)
(2)-> GENE -> Ensembl 选择输出格式

  注意,所有要显示在结果里的输出格式都要选(包括我们输入的是Gene name格式,那么“Gene name”选择一样要选。否则,结果里不会显示输入的数据,只有一堆转换后的ID,无法输入输出一一对应)。
  所以,我们选择了Gene stable ID(输出)、Transcript stable ID(输出)、Gene name(输入)。
在这里插入图片描述

(3)-> External References

  同样还在Attributes下GENE里的子选项,下拉。在External References 中,其它的输出格式按需求选择。我们选择了miRBase ID(输出)。此处最多能选择3项。
在这里插入图片描述

4 结果的输出及下载保存

(1)-> (网页左上角)点Results

  得到结果,包括了我们的输入列Gene name,输出列 Gene stable ID、Transcript stable ID和miRBase ID。

(2)-> 下载格式选 XLS
(3)-> GO

  然后就可以下载到这个表格的xls版本啦。
在这里插入图片描述

下面开始BioMart的技术总结

  1. 流程就是以上这么个流程,步骤做一遍就清晰了。
  2. 关键是输入格式要选对,注意BioMart所给的ID例子,一定要完全对应,否则无法识别。
  3. 输出选项里,注意要把输入格式也选上,否则输入选项并不会显示在结果里。
  4. 例子里一共选了4个属性选项,所以得到4个输出列。合理运用BioMart,按需选择输入格式和输出格式,就能对多种RNA做多种ID转换了。

附 Excel分列小技巧

之前同学的同学问我怎么把带版本号的mRNA的Gene ID转换成mRNA的Gene name。
一开始他是在NCBI一个一个查,我觉得吧,可以是可以,没必要是真的没必要,这时BioMart就很好用啦。

他的原数据是这样的(第一列):


由于他的原始数据中mRNA Gene ID 是带小数的,而这个小数并不影响转换得到对应Gene name,直接把放入BioMart作为Gene stable ID又无法被识别。可以选择用excel的分列功能,批量将小数删去。(当然还有很多种删掉小数的方法,这里只是示范一种简单的方法,来让我们的数据和BioMart的要求对应上。)

操作如下:
用Excel打开数据 -> 全选我们的数据 -> 工具栏[数据] -> [分列] -> 选[分隔符号] -> [下一步]
在这里插入图片描述


-> 选[其它] -> 输入“.” -> [下一步] -> [完成]


结果如下图。



欢迎留言讨论与交流~

lotusng:
major in CS
foucs on 生信数据挖掘与算法设计

这篇关于【生信笔记】Emsenbl的BioMart工具:对RNA进行多种ID批量转换的文章就介绍到这儿,希望我们推荐的文章对编程师们有所帮助!



http://www.chinasem.cn/article/196172

相关文章

使用Jackson进行JSON生成与解析的新手指南

《使用Jackson进行JSON生成与解析的新手指南》这篇文章主要为大家详细介绍了如何使用Jackson进行JSON生成与解析处理,文中的示例代码讲解详细,感兴趣的小伙伴可以跟随小编一起学习一下... 目录1. 核心依赖2. 基础用法2.1 对象转 jsON(序列化)2.2 JSON 转对象(反序列化)3.

Java枚举类实现Key-Value映射的多种实现方式

《Java枚举类实现Key-Value映射的多种实现方式》在Java开发中,枚举(Enum)是一种特殊的类,本文将详细介绍Java枚举类实现key-value映射的多种方式,有需要的小伙伴可以根据需要... 目录前言一、基础实现方式1.1 为枚举添加属性和构造方法二、http://www.cppcns.co

C#使用SQLite进行大数据量高效处理的代码示例

《C#使用SQLite进行大数据量高效处理的代码示例》在软件开发中,高效处理大数据量是一个常见且具有挑战性的任务,SQLite因其零配置、嵌入式、跨平台的特性,成为许多开发者的首选数据库,本文将深入探... 目录前言准备工作数据实体核心技术批量插入:从乌龟到猎豹的蜕变分页查询:加载百万数据异步处理:拒绝界面

Python使用自带的base64库进行base64编码和解码

《Python使用自带的base64库进行base64编码和解码》在Python中,处理数据的编码和解码是数据传输和存储中非常普遍的需求,其中,Base64是一种常用的编码方案,本文我将详细介绍如何使... 目录引言使用python的base64库进行编码和解码编码函数解码函数Base64编码的应用场景注意

Python基于wxPython和FFmpeg开发一个视频标签工具

《Python基于wxPython和FFmpeg开发一个视频标签工具》在当今数字媒体时代,视频内容的管理和标记变得越来越重要,无论是研究人员需要对实验视频进行时间点标记,还是个人用户希望对家庭视频进行... 目录引言1. 应用概述2. 技术栈分析2.1 核心库和模块2.2 wxpython作为GUI选择的优

Java进行文件格式校验的方案详解

《Java进行文件格式校验的方案详解》这篇文章主要为大家详细介绍了Java中进行文件格式校验的相关方案,文中的示例代码讲解详细,感兴趣的小伙伴可以跟随小编一起学习一下... 目录一、背景异常现象原因排查用户的无心之过二、解决方案Magandroidic Number判断主流检测库对比Tika的使用区分zip

Java实现时间与字符串互相转换详解

《Java实现时间与字符串互相转换详解》这篇文章主要为大家详细介绍了Java中实现时间与字符串互相转换的相关方法,文中的示例代码讲解详细,感兴趣的小伙伴可以跟随小编一起学习一下... 目录一、日期格式化为字符串(一)使用预定义格式(二)自定义格式二、字符串解析为日期(一)解析ISO格式字符串(二)解析自定义

Java使用Curator进行ZooKeeper操作的详细教程

《Java使用Curator进行ZooKeeper操作的详细教程》ApacheCurator是一个基于ZooKeeper的Java客户端库,它极大地简化了使用ZooKeeper的开发工作,在分布式系统... 目录1、简述2、核心功能2.1 CuratorFramework2.2 Recipes3、示例实践3

在java中如何将inputStream对象转换为File对象(不生成本地文件)

《在java中如何将inputStream对象转换为File对象(不生成本地文件)》:本文主要介绍在java中如何将inputStream对象转换为File对象(不生成本地文件),具有很好的参考价... 目录需求说明问题解决总结需求说明在后端中通过POI生成Excel文件流,将输出流(outputStre

mysql数据库重置表主键id的实现

《mysql数据库重置表主键id的实现》在我们的开发过程中,难免在做测试的时候会生成一些杂乱无章的SQL主键数据,本文主要介绍了mysql数据库重置表主键id的实现,具有一定的参考价值,感兴趣的可以了... 目录关键语法演示案例在我们的开发过程中,难免在做测试的时候会生成一些杂乱无章的SQL主键数据,当我们