2015 Introduction à la génétique quantitative - Cours 1 Jacques David, & Patrice David
1
Le Modèle Génétique et le cas biallélique
Bibliographie
A. Gallais 1990. théorie de la sélection en amélioration des plantes. Collections Sciences
Agronomiques Masson
Falconer and Mackay Introduction to quantitative genetics, Longman,
4ème
Edition, 1996.
I. Introduction de la notion d’héritabilité, effets génétiques et
environnementaux
La valeur d’un phénotype résulte d’effets génétiques et environnementaux. La réalité biologique est très
complexe : de nombreux gènes interagissent en réseaux, leurs interactions ne sont pas linéaires et dépendent des
facteurs environnementaux. Pour autant, cette complexité, quasiment inaccessible à une compréhension ou
modélisation exhaustive, n’empêche pas, à défaut de l’expliquer, de décrire la variation phénotypique
simplement au travers d’une approche biométrique. Il suffit que cette modélisation (la génétique
quantitative) ait un minimum de portée prédictive au moins à court terme (quelques générations) pour justifier
son intérêt. Si ce modèle peut rendre cause de la ressemblance entre les individus apparentés, il
peut servir à étudier la transmission des caractères.
(a) première étape : centrer le phénotype
Le but de la GQ (génétique quantitative) est d’obtenir une approche statistique de la variation du
caractère entre individus dans une population. Ainsi, cette approche ne prédira pas la valeur
absolue d’un caractère (« la taille de cet individu est 1.50 cm ») mais raisonnera en termes de
déviation par rapport à une référence qui est la moyenne actuelle de cette population (« cet individu
fait 20 cm de moins que la moyenne »). La première étape est donc de « centrer » les mesures de
phénotype en écrivant
Z = µ + P
Où Z est le phénotype dans son échelle de départ (par exemple la taille 1.50cm) ; µ est le phénotype
moyen de la population (par exemple 1.70 cm) et P le phénotype centré (par exemple -0.20 cm).
Travailler sur P au lieu de Z a plusieurs avantages : (i) éviter de poser des questions qui n’ont pas de
sens (par exemple : est-ce que la taille de cet individu est 1.50m à cause des gènes ou à cause de
l’environnement ?; alors que la question «est-ce que untel a une taille inférieure à la moyenne à cause
de ses gènes ou à cause de ses conditions de vie ou les deux ? a un sens)) (ii) La moyenne de P est
par définition zéro, ce qui est très pratique pour les modèles qui suivent...
(b) deuxième étape : décomposer P en effets génétiques et environnementaux
On écrit simplement
P = G + E + GxE
P : le phénotype, G le génotype et E l’environnement.
Le terme GxE signifie qu’il y a une interaction entre les gènes et les conditions environnementales,
c'est-à-dire que les effets des différents gènes en présence ne réagissent pas de la même façon aux
conditions de l’environnement. Cette interaction doit être écrite pour un modèle parfaitement général ;
2015 Introduction à la génétique quantitative - Cours 1 Jacques David, & Patrice David
2
mais dans le reste de ce chapitre, on néglige ces effets (faisant implicitement l’hypothèse que le
système se comporte comme si les effets du génotype et ceux de l’environnement s’additionnaient)
.
Donc
P = G + E
La variance du phénotype (qui mesure sa quantité de variation dans la population) peut s’écrire
V(P) = V(G) + V(E) + 2 cov(G,E)
Où V(P) est la variance phénotypique, V(G) la variance génotypique et cov(G,E) la covariance entre
les deux effets.
Cov(G,E) est non nulle si les effets génétiques et environnementaux ne sont pas statistiquement
indépendants : c’est-à-dire si les génotypes ne sont pas distribués aléatoirement entre les
environnements (i.e. si certains génotypes sont plus représentés dans certains environnements). Lors
d’expérimentations contrôlées, cov(G,E) est nulle le plus souvent par construction (on se débrouille
pour répartir aléatoirement la distribution des lignées dans différentes parties du champ par exemple).
De manière plus risquée, on fait souvent cette même supposition pour les populations naturelles.
D’où :
V(P) = V(G) + V(E)
L’héritabilité au sens large est alors définie comme
H2 = V(G) / V(P)
Elle correspond donc à la part de variance génotypique sur la variance totale
Elle correspond aussi à la régression qui prédit la valeur génotypique à partir de la valeur
phénotypique
b(G ;P) = cov(P, G)/ V(P)= V(G)/V(P)
Plus l’héritabilité est élevée plus la valeur génotypique est proche de la valeur phénotypique.
(c) régression parent-enfant dans le cas d’une reproduction par clonage
L’héritabilité au sens large permet de prédire, dans le cas d’une reproduction asexuée, le phénotype
d’un enfant à partir de celui de son parent (un seul parent en cas de clonage). Le cas de lignées pures
issues d’autofécondations répétées est identique à celui du clonage asexué (descendant
génétiquement identique à son unique parent).
Régression parent-enfant (ou Parent-Offspring)
Chaque point représente le phénotype d’un parent P et de son enfant O (pour offspring). Le coefficient
de régression b(P
o
, P
p
) est la pente de la droite.
2015 Introduction à la génétique quantitative - Cours 1 Jacques David, & Patrice David
3
PP: phénotype du parent
PO: phénotype du descendant
b(Po,Pp)
PP: phénotype du parent
PO: phénotype du descendant
b(Po,Pp)
Nous avons
b(P
o
, P
p
) = Cov (P
o
, P
p
) / V(P
p
) = Cov (P
o
, P
p
) / V(P)
et
Cov (P
o
, P
p
)= Cov (G
o
+E
o
, G
p
+E
p
) = Cov (G
o
, G
p
)+Cov (E
o
, G
p
)+Cov (G
o
, E
p
)+Cov (E
o
, E
p
)
Cov (G
o
, G
p
) = Cov (G
p
, G
p
) = V(G) car la reproduction par clonage fait que le descendant et le parent
ont le même génotype (G
p
=G
o
)
Cov (E
o
, G
p
) = 0 si le génotype du parent n’influence pas l’environnement du descendant ; on suppose
ceci vrai en particulier s’il n’y a pas d’effets maternels forts.
Cov (G
o
, E
p
) = 0 toujours car le génotype du descendant ne peut pas dépendre des conditions de vie
du parent.
Cov (E
o
, E
p
) = 0 (i) s’il n’y a pas d’effets maternels (ii) si le descendant est élevé dans un
environnement qui n’a rien à voir avec celui de son parent
Moyennant toutes ces conditions on obtient Cov (P
o
, P
p
) = V(G) d’où
b(Po, Pp) = V(G) / V(P) = H2 (reproduction clonale ou autofécondation)
II. Dissection de la valeur génétique dans le cas d’organismes sexués
(a) Le modèle génétique
La population considérée est panmictique, son effectif est illimité. On étudie la valeur du
génotype à un locus unique (on suppose donc pour l’instant qu’il n’y a qu’un locus, ayant
éventuellement de nombreux allèles) qui fait varier le caractère. Les allèles en ségrégation dans la
population sont notés Bx et un individu est par exemple noté BiBj (premier allèle d’origine maternelle,
second paternel), avec la possibilité que i=j. Soit Gij sa valeur génétique. On décompose Gij dans le
modèle suivant :
2015 Introduction à la génétique quantitative - Cours 1 Jacques David, & Patrice David
4
G
ij= ai + aj + bij
où
a
i
(a
j
) l'effet aléatoire de l'allèle i (j) auquel on peut associer une variance V(a
i
)=V(a
j
)=V(a) qui reflète
le tirage aléatoire de l'allèle paternel (maternel) dans la population
b
ij
est l'interaction entre les gamètes i et j à laquelle on peut associer une variance V(b
ij
)
Le terme b
ij
doit être ajouté car de manière générale, les allèles i et j n’interagissent pas simplement
de manière additive : par exemple des allèles peuvent être dominants sur d'autres. Si l’on ne met pas
le b
ij
on contraint les hétérozygotes BiBj à être exactement intermédiaires entre les homozygotes BiBi
et les BjBj quels que soient i et j.
Par définition d’un modèle statistique, nous pouvons contraindre E(a
i
)=E( a
j
) =0 (sachant que nous
avons déjà contraint E(G
ij
)=0) ;
a
i
, (average effect, notation due à Fisher) est par définition la valeur génotypique moyenne des
individus dont l'allèle paternel Bi (et de ceux dont l'allèle maternel est Bi). En l’absence de covariance
génotype-environnement c’est aussi la moyenne du phénotype (centré) des individus ayant un allèle
paternel (ou maternel) Bi.
a
i = Ej(Gij) = Ej(Pij)
Où Ej(Gij) signifie “espérance de Gij sur tous les j possibles, en ayant fixé i”.
Le terme d’interaction est défini par
bij = Gij - ai - aj
Par conséquent, pour n’importe quelle valeur fixée de i ou de j, l’espérance de bij est nulle ainsi que sa
covariance avec les a.
Ej(bij) = Ej(Gij)-Ej(ai)-Ej(aj) =ai-ai-0 = 0
Covj (bij,ai) = Ej(bij ai) = ai Ej(bij) = 0
De même la covariance entre b
ij et bik
, j et k étant tirés indépendamment, est nulle
Cov
jk (bij,bik) = Ejk(bijbik) = Ej(Ek(bijbik))= Ej(bij Ek(bik))= Ej(bij 0)= 0
(b) Variances génétiques
On peut donc développer la variance génotypique V(G)
V(G)=V[a
i + aj + bij]
= V(ai) + V(aj) + V(bij) + 2 cov(ai aj)+2 cov(ai bij)+2 cov(aj bij)
2015 Introduction à la génétique quantitative - Cours 1 Jacques David, & Patrice David
5
Les termes cov(a
i
b
ij
) et cov(a
j
b
ij
) sont nuls par construction
cov(a
i
a
j
) est nulle si les allèles paternels et maternels sont tirés indépendamment, ce qui est le
cas pour un individu quelconque en panmixie.
Par ailleurs V(a
i
) = V(a
j
)=V(a)
On pose classiquement :
- la variance additive V
A
= 2 V(a) (la breeding value est Aij= a
i + aj)
- la variance de dominance V
D
= V(b
ij
)
d’où
V(G)= V
A
+V
D
L’héritabilité au sens strict est définie par
h² = V
A
/ V(P)
(c) Extension à plusieurs locus
Quand plusieurs locus déterminent le caractère, il faut élargir le modèle :
(i) faire la somme des effets a
i (k)
a
j (k)
et b
ij (k)
produits par tous les locus k.
(ii) ajouter des termes d’interaction très nombreux si les interactions entre locus ne sont pas purement
additives (interactions entre un allèle du locus 1 et un allèle du locus 2, entre un allèle du locus 1 et
une paire d’allèles du locus 2, entre deux paires d’allèles aux locus 1 et 2... etc) ; toutes ces
interactions représentent ce qu’on désigne collectivement par « épistasie »
Par ailleurs la condition de panmixie à la génération précédente assure que les allèles paternels sont
indépendants des maternels MAIS elle n’assure pas que les allèles maternels au locus 1 soient
indépendants des allèles maternels au locus 2 ... on peut donc avoir des covariances non nulles entre
des effets alléliques d’une même origine (des cov (
ai (k), aj (l)
) qui vont intervenir dans l’expression de
la variance génétique totale. Ces covariances seront nulles s’il n’y a pas de déséquilibre de liaison
(ou déséquilibre gamétique)... moyennant cette condition on aura
V(G)= VA +VD + VI
Où
V
A
est la somme des variances additives des différents locus
V
D
est la somme des variances de dominance des différents locus
V
I
désigne la variance d’interaction entre locus (= épistasie), c’est-à-dire un gros paquet hétéroclite
d’interactions... souvent on les considère comme faibles ou nulles, car elles sont difficiles à quantifier !
(d) régression parent-enfant en reproduction sexuée
En reprenant le même calcul qu’en population asexuée, on obtient (toutes les étapes du calcul étant
identiques) la covariance mère-enfant :
cov( PM, PO) =cov( GM, GO)
1 / 13 100%
La catégorie de ce document est-elle correcte?
Merci pour votre participation!

Faire une suggestion

Avez-vous trouvé des erreurs dans l'interface ou les textes ? Ou savez-vous comment améliorer l'interface utilisateur de StudyLib ? N'hésitez pas à envoyer vos suggestions. C'est très important pour nous!