在扩增子数据分析中,有时会发现多个OTU 注释到了同一个species ,  为什么会出现这种情况呢?

首先既然在OTU水平能分开,说明序列的相似度小于97%,  同一个物种的同一个基因的片段相似度会小于97%吗?

答案是肯定的;

对细菌,古菌,真菌来说,在species 水平下面,还有1个strain 水平,而同一个species的不同strain, 有可能会相似度小于97%;

以RDP 下载的 Fungi 数据来说,在原始数据中,会有很多类似下面这种的序列

>S000448483 Sparassis crispa; MBUH-PIRJO&ILKKA94-1587/ss5
>S000448484 Sparassis crispa; MBUH-ILKKA88-2036/ss6
>S000415306 Sparassis crispa; MAFF 238626
>S000448480 Sparassis crispa; YCD2470/ss2
>S000448481 Sparassis crispa; YCD2637/ss3
>S000448482 Sparassis crispa; MBUH-SAVOLAINEN/ss4
>S000448487 Sparassis crispa; zw-clarku003/ss9
>S000448488 Sparassis crispa; BMS2857/ss10
>S000448479 Sparassis crispa; YCD2145/ss1
>S000448492 Sparassis crispa; HKAS15728/ss19
>S000448493 Sparassis crispa; HKAS32363/ss20
>S000448491 Sparassis crispa; HMAS60590/ss17
>S000448496 Sparassis crispa; RB9/6/87/ss23
>S000448494 Sparassis crispa; HKAS17477/ss21
>S000448498 Sparassis crispa; MBUH-DORISLABER/ss25
>S000448506 Sparassis crispa; FFPRI-TSENGOKU/ss34
>S003841092 Sparassis crispa; JB10
>S000448501 Sparassis crispa; TENN44575/ss28
>S003827683 Sparassis crispa; HKAS43721; AFTOL-ID 703
>S003856778 Sparassis crispa

我截取了部分,前面的 "Sparassis crispa" 是1个物种,而;后面类似 "MBUH-PIRJO&ILKKA94-1587/ss5" 则是不同的strain,

"MBUH-PIRJO&ILKKA94-1587/ss5" 在NCBI 的Nuclteotide 数据库的链接如下

https://www.ncbi.nlm.nih.gov/nuccore/AY218534.1

通过上图,一目了然,species 和 strain 的关系,1个物种有很多的strain , 而在这些strain 之间,就会存在相似度小于 97% 的strain。

RDP 数据库简介的更多相关文章

  1. MongoDB数据库简介及安装

    一.MongoDB数据库简介 简介 MongoDB是一个高性能,开源,无模式的,基于分布式文件存储的文档型数据库,由C++语言编写,其名称来源取自"humongous",是一种开源 ...

  2. Oracle数据库简介

    Oracle数据库简介 一.介绍 Oracle数据库系统是美国Oracle(甲骨文)公司提供的以分布式数据库为核心的一组软件产品,是目前最流行的客户/服务器(Client/Server,C/S)或浏览 ...

  3. 数据库 简介 升级 SQLite 总结 MD

    Markdown版本笔记 我的GitHub首页 我的博客 我的微信 我的邮箱 MyAndroidBlogs baiqiantao baiqiantao bqt20094 baiqiantao@sina ...

  4. MongoDB,无模式文档型数据库简介

    MongoDB的名字源自一个形容词humongous(巨大无比的),在向上扩展和快速处理大数据量方面,它会损失一些精度,在旧金山举行的MondoDB大会上,Merriman说:“你不适宜用它来处理复杂 ...

  5. 全球第一开源ERP Odoo操作手册 数据库简介

    1.3 数据库简介 每一个独立核算的企业都有一套相互关联的账簿体系, 把这一套完整的账簿体系建立在计算机系统中就称为一个数据库. 一般一个企业只用一个数据库. 如果企业有几个下属的独立核算的实体,也可 ...

  6. rrnDB数据库简介-16S基因多拷贝数的证据

    16S基因作为mark gene在微生物群落结构的研究中发挥中重要作用, 但是候选的mark gene 肯定不止16S 一种,最新比较火热的功能基因,也可以作为mark gene.利用功能基因作为ma ...

  7. MySql数据库基础之数据库简介及安装

    MySql数据库简介: 众所周知,MySql数据库是一款开源的关系型数据库,在Web应用方面,MySql是最好的.最流行的RDBMS(Relational Database Management Sy ...

  8. Scopus数据库简介

    ScienceDirect数据库1. Elsevier简介荷兰Elsevier 是全球最大的科学文献出版发行商,已有180多年的历史.其产品涵盖科学.技术和医学等各个领域,包括1800多种学术期刊(大 ...

  9. 数据库----ORACLE和MYSQL数据库简介

    一.什么是数据库? 数据库(Database---DB)按照组织.储存和管理数据的仓库.(理解以下三个概念)   数据(Data)用来描述事物的记录都可称数据,如文字音乐图像.   数据库系统(Dat ...

随机推荐

  1. Java虚拟机详解----常用JVM配置参数

    本文主要内容: Trace跟踪参数 堆的分配参数 栈的分配参数 零.在IDE的后台打印GC日志: 既然学习JVM,阅读GC日志是处理Java虚拟机内存问题的基础技能,它只是一些人为确定的规则,没有太多 ...

  2. java.net.SocketException四大异常解决方案

    java.net.SocketException如何才能更好的使用呢?这个就需要我们先要了解有关这个语言的相关问题.希望大家有所帮助.那么我们就来看看有关java.net.SocketExceptio ...

  3. JDBC(7)—DAO

    介绍: DAO(Data Access Object):数据访问对象 1.what:访问数据信息的类,包含了对数据的CRUD(create read.update.delete),而不包含业务相关的信 ...

  4. Android:TextView控件

    3.2.1    TextView TextView 可以说是 Android 中最简单的一个控件了,你在前面其实也已经和它打过了一 些打交道.它主要用于在界面上显示一段文本信息,比如你在第一章看到的 ...

  5. python测试开发django-46.xadmin添加action动作

    前言 Action插件在数据列表页面上提供数据选择功能.可以在Action之后专门处理所选数据.批量删除功能作为默认操作提供. action文档 要启用Action,开发人员可以设置Model Opt ...

  6. Java中的语法糖

    一.范型 1. C#和Java范型的区别 在C#中范型是切实存在的,List<int>和List<String>就是两种不同的类型,它们在系统运行期间生成,有自己的虚方法表和类 ...

  7. iOS开发-NSDate获取当前时区时间

    NSDate Date默认显示的是格林尼治所在地的标准时间(GMT),转换为中国时区需要加上八个小时,针对与这个情况你可以直接在获取时间之后加上八个小时,也可以转换到当前时区,都很简单,代码参考如下: ...

  8. MySQL架构与业务总结图

    MySQL架构与业务总结图如下:

  9. windows多线程同步--信号量

    推荐参考博客:秒杀多线程第八篇 经典线程同步 信号量Semaphore   首先先介绍和windows信号量有关的两个API:创建信号量.释放信号量   HANDLE WINAPI CreateSem ...

  10. 使用DIV弹出框的代码示例,备忘。

    1.思路 使用DIV模拟弹出框,一共用三个div: divWindow: 原来的界面内容区域 divLogin:要弹出的内容区域 divBackground:给弹出内容区域做个遮罩的区域. 点击 “请 ...