I.9 Linkage

INDEPENDENCE OF GENOTYPES AT TWO LOCI:若A,B是两个独立位点:PA是基因A的概率,PB是基因B的概率。因为基因A与基因B是相互独立的位点,所以基因型AABB的概率为PAABB=(PA)^2*(PB)^2

A RETROSPECTIVE DERIVATION.:

前提一:假设存在两个种群,这两个种群中:A的基因频率PA=1/2、B的基因频率PB=1/2。其中种群1:配子AB和ab各占1/2;种群2:配子Ab,AB,aB,ab各占1/4。因为基因频率不发生改变,所以配子AB的频率一直保持1/4,即PAB=1/4。

前提二:设重组率为r,在第t个世代下,亲代的AB配子频率是PAB。减数分裂过程中存在两种情况:

  1. 不发生重组:概率为1-r,此时配子中的AB都来自一个亲代(本质上认为C=AB,即配子上的C基因,该基因频率满足哈代公式(因为从亲代到任何一代子代都是随机交配的),所以基因频率不发生改变,所以PAB不发生改变)
  2. 发生重组:概率为r,配子中的AB分别来自该亲代的上一代,该亲代的上一代的配子频率,就是该亲代的基因频率,所以本质上是计算亲代中基因型为AB的频率PAB,则为PAPB(上一代配子频率相乘)

基于以上分析,得到第一代配子为AB的频率为:

第一代子代配子是AB的频率,即PAB1,即AB发生连锁的频率

亲代配子是AB的频率,即PAB,即AB发生连锁的频率

PAPB是组成AB配子不发生连锁,仅发生重组的频率,所以可以通过此式分析不同世代之间(连锁与重组)的差异,并将这些差异定义为D(t)其中,t为第几世代,所以:

当计算无穷世代时,便令t->正无穷,因为指数函数,底数为小数,当自变量趋近于无穷时,整个函数值趋近于0,所以得到:

此时基因A与基因B都满足哈代平衡且独立遗传。

所以,最后的平衡称为连锁平衡linkage equilibrium,DAB(t)值称为连锁不平衡参数(linkage disequilibrium)

连锁平衡是在遗传过程中,不同基因座上的等位基因按照随机 原则进行组合时,不同基因座的等位基因组 合的频率等于组合等位基因各自频率的积, 不存在优势组合。这种基因座间没有相关性的状态称为连锁平衡,此时连锁不平衡参数值为0。

连锁不平衡: 在某一群体中,不同座位上某两个等位基因出现在同一条单元型上的频率与预期的随机频率之间存在明显差异的现象,称连锁不平衡

将DAB(t)打开可得到以下表达式:

(1-r)^t代表直到t个世代为止,发生连锁的概率,这些连锁的基因导致了一系列的连锁不平衡。

1-((1-r)^t)代表直到t个世代为止,发生重组的概率

PAB(0)是亲代便是AB连锁的概率

PAPB是AB重组的概率

连锁不平衡现象终会发展为连锁平衡。

进化角度:Recombination gradually scrambles the initial associations of alleles at different loci, until a state of complete randomness is obtained, in which each chromosome is a patchwork of segments derived from different ancestors.

所以,若存在AB基因的连锁平衡,则A基因和B基因是独立遗传,不会相互影响。

SIMPLIFYING POPULATION GENETICS: THE GENE POOL:

如果配子有20个基因座,则配子有2^20种基因型,则组成的二倍体有2^40种基因型,则可区分的基因型有3^20种(eg,原本是四种基因型AA,Aa,aa,Aa,但实际上只有三种基因型,AA,Aa,aa)在连锁平衡之前,配子pool不等于基因pool;在连锁平衡之后,可以通过研究配子基因型(配子pool就是基因pool)来研究二倍体基因型。

A MORE DIRECT DERIVATION:

亲代配子为AB的频率是PAB

则产生ABAB子代的频率是PABAB=PABPAB,该子代产生配子AB的概率是1

分析如下:

总结后得到:

将产生子代第一代配子为AB的频率总结得到:

依据配子概率之和为1以及配子的概率关系,得到:

化简:

该式说明了第一代子代配子由连锁的亲代配子和重组的配子组成。

显然红框中的式子相等,所以:

这说明了连锁和重组之间的差异在于双杂合子基因型频率的差异。

因为连锁不平衡参数D被定义为连锁概率-重组概率,所以,对于所有可能配子频率(单体型频率),有如下频率(对于单体型来说是基因型频率)

根据式子两两比较,可以得知,

根据基因频率与基因型的关系,可以得知

因此,所有不平衡参数可定义为一个变量D,所以:

相似的,可以将该等位基因A,a推广到所有等位基因A1A2A3A4……,在不断繁衍过程中,连锁不平衡参数将会不断向0靠近,并且以(1-r)^t的速度靠近0。

linkage disequilibrium|linkage equilibrium的更多相关文章

  1. GWAS | 全基因组关联分析 | Linkage disequilibrium (LD)连锁不平衡 | 曼哈顿图 Manhattan_plot | QQ_plot | haplotype phasing

    现在GWAS已经属于比较古老的技术了,主要是碰到严重的瓶颈了,单纯的snp与表现的关联已经不够,需要具体的生物学解释,这些snp是如何具体导致疾病的发生的. 而且,大多数病找到的都不是个别显著的snp ...

  2. chromosome interaction mapping|cis- and trans-regulation|de novo|SRS|LRS|Haplotype blocks|linkage disequilibrium

    Dissecting evolution and disease using comparative vertebrate genomics-The sequencing revolution   s ...

  3. Linkage Disequilibrium|D‘|r2

    I.10 Other Measures of Linkage Disequilibrium 因为D的取值强烈地依赖于人为制定的等位基因频率(PA及PB),所以它不利于LD程度的比较.标准化的不平衡系数 ...

  4. signals function|KNN|SVM|average linkage|Complete linkage|single linkage

    生物医疗大数据 存在系统误差使得估计量有偏,如下图红色和蓝色图形,存在随机误差使得估计量并不是同一个值,如图中除去期望之外的曲线值,为了控制随机抽样造成的误差,可以使用p-value决定是否服从假设检 ...

  5. 收集vcftools所有用法

    VCFtools用来处理VCF文档. 筛选特定突变 比较文件 总结突变 转化文件格式 验证并合并文件 取突变交集和差集 Get basic file statistics input可以为VCF或BC ...

  6. VCFtools

    The C++ executable module examples This page provides usage examples for the executable module. Exte ...

  7. GWAS Catalog数据库简介

    GWAS Catalog The NHGRI-EBI Catalog of published genome-wide association studies EBI负责维护的一个收集已发表的GWAS ...

  8. GWAS 全基因组关联分析 | summary statistic 概括统计 | meta-analysis 综合分析

    有很多概念需要明确区分: 人有23对染色体,其中22对常染色体autosome,另外一对为性染色体sex chromosome,XX为女,XY为男. 染色体区带命名:在标示一特定的带时需要包括4项:① ...

  9. Dnasp计算LD

    Dnasp计算LD Table of Contents 1 Dnasp 计算LD 1 Dnasp 计算LD Dnasp有很多的功能,现在主要来记录其计算LD的功能. 首先File——然后打开data— ...

随机推荐

  1. UVALive 4487 Exclusive-OR 加权并查集神题

    已知有 x[0-(n-1)],但是不知道具体的值,题目给定的信息 只有 I P V,说明 Xp=V,或者 I P Q V,说明 Xp ^ Xq=v,然后要求回答每个询问,询问的是 某任意的序列值 Xp ...

  2. 学术Essay写作中Introduction的正确打开方式

    其实在学术essay写作过程中,很多留学生经常不知道如何写introduction,所以有些开头的模板句就出现了,比如,With the development of society/With the ...

  3. 利用libpcap抓取数据包

    转载自:http://blog.csdn.net/tennysonsky/article/details/44811899 概述 libpcap是一个网络数据包捕获函数库,tcpdump就是以libp ...

  4. 2020/1/31 PHP代码审计之文件包含漏洞

    0x00 文件包含简介 文件包含漏洞的产生原因是在通过引入文件时,引用的文件名,用户可控,由于传入的文件名没有经过合理的校检,或者校验被绕过,从而操作了预想之外的文件,就可能导致意外的文件泄露甚至恶意 ...

  5. [极客大挑战 2019]BabySQL

    0x00 知识点 双写绕过 简单测试一下,发现or在登陆过程被过滤,想到使用oorr试试,结果成了?! 最后多测试一下,发现from union select 这些关键函数都被替换为空 本题直接进行常 ...

  6. openstack trove redis配置项

    trove在mitaka版本更新了一个功能,configuration 具体如下: trove help |grep configuration configuration-attach Attach ...

  7. 18 12 23 html 基本学习

    一个html的基本结构如下: <!DOCTYPE html> <html lang="en"> <head> <meta charset= ...

  8. BZOJ 4855 [Jsoi2016]轻重路径

    题解:用树链剖分来维护树链剖分 令d[x]=size[heavyson[x]]-size[lightson[x]] 当d[x]<0时轻重儿子关系改变 用数据结构维护d[x]并找到这些位置改变即可 ...

  9. (转)Java中的容器详细总结

    Java中的容器详细总结(编辑中) 原文链接:http://anxpp.com/index.php/archives/656/ 注:本文基于 Jdk1.8 编写 通常程序总是根据运行时才知道的某些条件 ...

  10. java类的实例化顺序

    1. 父类静态成员和静态初始化块 ,按在代码中出现的顺序依次执行 2. 子类静态成员和静态初始化块 ,按在代码中出现的顺序依次执行 3. 父类实例成员和实例初始化块 ,按在代码中出现的顺序依次执行 4 ...