Robustess of Phylogenetic Trees

Résumé : La théorie synthétique de l'évolution a largement diffusé dans tous les domaines de la biologie, notamment grâce aux arbres phylogénétiques. S'ils ont une utilité évidente en génomique comparative, ils n'en sont pas moins utilisés dans de nombreux autres domaines allant de l'étude de la biodiversité à l'épidémiologie en passant par les sciences forensiques. Les arbres phylogénétiques sont non seulement une charactérisation efficace mais aussi un outil puissant pour étudier l'évolution. Cependant, toute utilisation d'arbre dans une étude suppose que l'arbre ait été correctement estimé, tant au niveau de la topologie que des autres paramètres, alors que cette estimation est un problème statistique compliqué et encore très ouvert. On admet généralement qu'on ne peut faire de bonne estimation sans les quatre pré-requis que sont (1) le choix d'un ou plusieurs gènes pertinents pour la question étudiée, (2) une quantité suffisante de données pour s'assurer une bonne précision d'estimation, (3) une méthode de reconstruction efficace qui s'appuie sur une modélisation fine de l'évolution pour minimiser les biais de reconstruction, (4) un bon échantillonnage de taxons. Nous nous intéressons dans cette thèse à quatre thèmes étroitement liés à l'un ou l'autre de ces pré-requis. Dans la première partie, nous utilisons des inégalités de concentration pour étudier le lien entre précision d'estimation et quantité de données. Nous proposons ensuite une méthode basée sur des extensions de Edgeworth pour tester la congruence phylogénétique d'un nouveau gène avec ses prédécesseurs. Dans la deuxième partie, nous proposons deux méthodes, inspirées des analyses de sensibilités, pour détecter les sites et taxons aberrants. Ces points aberrants peuvent nuire à la robustesse des estimateurs et nous montrons sur des exemples comment quelques observations aberrantes seulement suffisent à drastiquement modifier les estimateurs. Nous discutons les implications de ces résultats et montrons comment augmenter la robustesse de l'estimateur de l'arbre en présence d'observations aberrantes.
Type de document :
Thèse
Mathematics [math]. Université Paris Sud - Paris XI, 2009. English
Liste complète des métadonnées

Littérature citée [194 références]  Voir  Masquer  Télécharger

https://tel.archives-ouvertes.fr/tel-00472052
Contributeur : <>
Soumis le : vendredi 9 avril 2010 - 13:33:15
Dernière modification le : mardi 10 octobre 2017 - 11:22:04
Document(s) archivé(s) le : mardi 14 septembre 2010 - 18:16:36

Identifiants

  • HAL Id : tel-00472052, version 1
  • Mot de passe :

Collections

Citation

Mahendra Mariadassou. Robustess of Phylogenetic Trees. Mathematics [math]. Université Paris Sud - Paris XI, 2009. English. 〈tel-00472052〉

Partager

Métriques

Consultations de la notice

295

Téléchargements de fichiers

510