Development of statistical methods for DNA copy number analysis in cancerology. - TEL - Thèses en ligne Accéder directement au contenu
Thèse Année : 2016

Development of statistical methods for DNA copy number analysis in cancerology.

Développement de méthodes statistiques pour l'analyse du nombre de copies d'ADN en cancérologie.

Résumé

Genomic data from DNA microarray or sequencing technologies have two major characteristics: their high dimension (number of markers larger than the number of observations), and their strong structuration (dependence between markers). Taking into account this structuration, it is a challenging issue for the development of efficient methods. This work is focused on the data with a strong spatial structuration, namely DNA copy number data in tumor samples. We developed statistical models, software implementations and we applied these developments to real data. We explored in particular segmentation models and matrix factorization methods. All the software Implementations of these methods are freely available as R packages.
Les données génomiques issues d'expériences de puces à ADN ou de séquençage ont deux caractéristiques principales: leur grande dimension (le nombre de marqueurs dépassant de plusieurs ordres de grandeurs le nombre d'observations), et leur forte structuration (notamment via les dépendances entre marqueurs). La prise en compte de cette structuration est un enjeu clé pour le développement de méthodes performantes en grande dimension. Cette thèse est axée sur les données présentant une forte structure le long du génome. C'est le cas des données de nombres de copies d'ADN, mais aussi des données de génotypes. La thèse couvre à la fois le développement de méthodes statistiques, l'implémentation logicielle, et l'application des méthodes développées à des jeux de données réelles. Nous avons, en particulier, étudié des méthodes de segmentation, et de factorisation matricielle. Toutes les implémentations logiciel de ces méthodes sont librement disponibles sous forme de packages R.
Fichier principal
Vignette du fichier
these_simple.pdf (12.4 Mo) Télécharger le fichier
Loading...

Dates et versions

tel-01436012 , version 1 (16-01-2017)

Identifiants

  • HAL Id : tel-01436012 , version 1

Citer

Morgane Pierre-Jean. Development of statistical methods for DNA copy number analysis in cancerology.. Statistics [math.ST]. Université Paris Saclay, 2016. English. ⟨NNT : 2016SACLE056⟩. ⟨tel-01436012⟩
342 Consultations
492 Téléchargements

Partager

Gmail Facebook X LinkedIn More