Previous seminars – 2016

(archives from old symbiose site)

 

  • Biodiversity of the gut microbiome at a local scale: influence of diet, parasitism, and host genetics
    Laure Ségurel
    Thursday, December 15, 2016 – 10:30
    Room Aurigny
    Talk abstract: 

    Humans live in close proximity with multiple microbial communities living in/on them, of which the gut microbiome. This intimate relationship has been challenged many times during human evolutionary history, for example at the Neolithic revolution during the transition from a hunter-gatherer to a farming mode of subsistence, and more recently with the industrialization of human societies. It has notably been shown that there is a substantial loss of biodiversity and an important shift in gut microbiome composition in urban industrialized populations when compared to rural non-industrialized populations. However, the relative contribution of factors such as climate, diet, medicine, hygiene practices, host genetics, and parasitism to these patterns is still unclear. Here, we focus on fine-scale comparisons of African rural populations in order to (i) contrast the gut microbiomes of populations that inhabit similar environments but have different traditional diets (hunter-gatherers, farmers, fishers); (ii) evaluate the effect of parasitism on microbiome composition and structure; and (iii) identify host genetic variation that is associated with the microbiota in African populations. To this end, we profiled the gut microbiota, intestinal parasites, and host genetic variation in 64 individuals in Southwest Cameroon. We found that the presence of an intestinal protozoa, Entamoeba, is strongly correlated with microbial composition and diversity, such that an individual’s infection status can be predicted with 79% accuracy based on his/her gut microbiome composition. We also found gut communities to vary significantly with subsistence mode, with some taxa previously shown to be enriched in other hunter-gatherers groups (notably Succinivibrio sp. and Ruminobacter sp.). Our study thus highlights the substantial variability in gut microbiome composition among closely related populations and suggests an important role for eukaryotic gut inhabitants, one that has been largely overlooked in studies of the microbiome to date. 

     

  • Symbiose Non-permanent members Seminar
     
    Tuesday, December 13, 2016 – 09:30
    Room Aurigny
    Talk abstract: 

    Séminaire des CDD Symbiose 

    • 9h30 – Introduction
    • 9h35 – 10h 45 Session I – Séquences nucléiques
      • Antoine Limasset – Introduction à la bioinformatique des séquences, graphes et asssemblage
      • Sébastien François – Optimisation combinatoire en génomique : Cas pratique du scaffolding
      • Sébastien Letort – Assemblage de novo avec trace RDF Prov-O
      • Laurent Bouri – Introduction au séquençage de 3ème génération
      • Camille Marchet – La transcriptomique : le chaînon manquant des -omiques chez GenScale
    • 10h45 – 11h00 Pause café
    • 11h00 – 11h35 Session II-  Ecologie et populations
      • Cervin Guyomar – Introduction à la métagénomique : une histoire de symbiotes (du puceron)
      • Marie Chevallier – Vers l’Écologie des Systèmes
    • 11h35 – 12h00 Session III – Outils pour la BioInformatique
      • Chloé Riou – BioMAJ : moteur de workflow pour la gestion de données biologiques
      • Coline Thomas – Système d’information pour le projet Rapsodyn
      • Matéo Boudet – Introduction au cloud GenOuest
    • 12h00 – 12h15 Table ronde
    • 13h45 – 14h30 Suite Session III
      • Patrick Durand – GATB : tutoriel de nouvelle génération
      • Xavier Garnier – AskOmics, outil d’intégration et d’interrogation de données biologiques
      • Lucas Bourneuf  – Powergraph : graphes orientés visualisation
    • 14h30 – 15h50 Session IV – Réseaux métaboliques
      • Julie Laniau – Introduction aux réseaux métaboliques
      • Clémence Frioux – Allier programmation linéaire et combinatoire pour reconstruire les réseaux métaboliques
      • Meziane Aite – Reconstruction et analyse de réseau métabolique avec le workflow Aureme & padmet-toolbox
      • Victorien Delannée – Prédiction des métabolismes des xénobiotiques
      • Jean Coquet – Analyse des voies de signalisation du TGF-beta
      • Pierre Vignet – Modélisation de voies de signalisation liées au TGF-beta
    • 15h50 – Conclusion
    • 16h – Fin du séminaire et pot de départ de Laurent

     

  • L’utilité des codes Fibonacci
    Tomi Klein (Bar Ilan University)
    Thursday, December 8, 2016 – 10:30
    Room Aurigny
    Talk abstract: 

    The talk reviews several properties and applications of Fibonacci codes. These are fixed codeword sets, using binary representations of integers based on the Fibonacci sequence rather than on powers of 2. Applications range from robust data compression, over faster modular exponentiation to boosting the compression performance of rewriting codes for flash memory. No previous knowledge is assumed. 

    • De novo assembly of bacterial genomes from the seed microbiome.
      Matthieu Barret (INRA Angers)
      Thursday, November 24, 2016 – 10:30
      Room Aurigny
      Talk abstract: 

      Seeds are involved in the vertical transmission of microorganisms from one plant generation to another and consequently act as reservoirs for the plant microbiome. However, little is known about the structure of seed-associated microbial assemblages and the regulators of assemblage structure. In this talk, I will present recent data obtained by our research group on the taxonomic and functional composition of the seed microbiome. 

    • Inventaire et diversité des cibles génomiques potentielles des isoformes SETMAR
      Yves Bigot (INRA-CNRS tours)
      Thursday, November 17, 2016 – 10:30
      Room Aurigny
      Talk abstract: 

      Le gène Setmar est un néogène dérivé de la fusion de deux gènes, le premier codant un domaine SET et le second une transposase Hsmar1. Suivant la lignée de cellule cancéreuse, 11 isoformes protéiques d’une taille variant de 40 à 78 kDa sont des produits d’expression de ce gène. Diverses études se sont concentrées sur les fonctions de la plus grosse isoforme (78 kDa), en particulier sur celles portées par le domaine SET. Ces études montrent son implication potentielle dans la réparation de l’ADN, la décondensation de la chromatine, et la methylation de certains résidus lysines de l’histone H3 et du facteur d’épissage SnRNP70.

      En dehors de ses activités de clivage et de transfert de brin, pas (ou peu) de travaux se sont intéressés aux fonctions de la partie HSMAR1 de SETMAR in vivo. Pourtant, le domaine de liaison à l’ADN d’HSMAR1 est parfaitement fonctionnel et devrait in vivo au moins être capable de se lier aux ITRs des éléments Hsmar1 et de son MITE MADE1 dans les cellules qui expriment des isoformes SETMAR.

      Avant de traiter de la question des modes de liaison de SETMAR in vivo, nous nous avons été confrontés aux défauts de qualité de l’annotation RepeatMasker (RM) pour les Hsmar1 et des MADE1 dans le génome humain. Un nouvel inventaire a été produit en utilisant trois outils RM, logol, et la dernière version de BLAST et un processus de validation utilisant à la fois une approche bio-informatique et des données de CHIP-seq obtenues à partir de cellules exprimant différentes isoformes à partir du gène Setmar. Les conclusions de notre étude sont que les isoformes du gène Setmar contenant le domaine HSMAR1 se lient spécifiquement à l’ADN avec des modalités de liaison en partie différentes de celles observées in vitro.

    • High sensitivity sequence identification in metagenomics. Application to sequence space exploration of viruses in extreme environment.
      Clovis Galiez
      Thursday, November 10, 2016 – 10:30
      Room Métivier
      Talk abstract: 

      It is now common to deal with millions of protein sequences coming from metagenomic projects. A sizable part of it is usually left unannotated, up to 70% in the case of viruses. High sensitivity sequence search methods for remote homologs (PSI-Blast, HHblits) are not capable to cope with the amount of data generated by metagenomics.
      We will present, in the context of building a catalog of viral protein sequences, new tools that overcome this limitation. Specifically, we clustered the Uniprot down to 30% which allows to generate rich sequence profiles to identify previously unknown sequences. Moreover, the tool used for this clustering, MMseqs2, can search and cluster big sequence databases with high sensitivity at very high speed (speedup of 270x PSI-Blast with the same sensitivity). We will introduce the current method as well as the future improvements for profile-profile comparison and clustering in linear time that will respectively improve the sensitivity and speed up.

    • Sequence similarity networks, a pragmatical tool to explore processes acting on the microbial dark matter
      Lucie Bittner (Université Pierre et Marie Curie – Paris)
      Thursday, October 6, 2016 – 10:30
      Room Minquiers
      Talk abstract: 

      Sequence similarity networks (SSN) are extremely useful for biologists because, in addition to allowing a user-friendly visualization of the genetic diversity from huge high-throughput sequencing data sets, they can be studied analytically and statistically using graph topology metrics. SSN have recently been adapted to address an increasing number of biological questions investigating both patterns and processes: e.g. population structuring; genomes heterogeneity; microbial complexity and evolution; microbiome adaptation or to explore the microbial dark matter. In metagenomic microbial studies, SSN offer indeed an alternative to classical and potentially biased methods, and thus facilitate large-scale analyses and hypotheses generation, while notably including unknown/dark matter sequences in the global analysis. During this seminar, I will present concrete examples of microbial dark matter mining using SSN developed in my research team: (i) population structure of uncultivated microbes in the global ocean, (ii) research of ecological/life-traits biomarkers in massive functionally unannotated datasets.

       

    • The Common Workflow Language v1.0: ready for production, ready for the futur
      Michael R. Crusoe Community Engineer and co-founder, the Common Workflow Language project
      Thursday, September 29, 2016 – 10:30
      Room Markov
      Talk abstract: 

      The Common Workflow Language project produces standards that describe POSIX command line tools and workflows made from them. They also have a reference implementation and a growing community repository of CWL descriptions with an emphasis on bioinformatics. This talk will review the capabilities of the 1.0 release of the CWL standards and sketch out where the speaker sees these standards and community going over the next few years. Topics will include using and propagating metadata, models for community development and maintenance of workflows, and prospects for workflow conversion. The speaker is very interested in learning about related research efforts; time will be allotted for discussion.

       

       

       Common Workflow Language project: http://www.commonwl.org/

    • Problème à frontière libre pour la formation de protrusions à l’échelle de la cellule
      Clair Poignard (Inria Bordeaux)
      Thursday, September 22, 2016 – 10:30
      Room Aurigny
      Talk abstract: 

      Nous présentons un modèle à frontière libre à deux phases pour modéliser la formation de protrusions à l’échelle de la cellule. La membrane cellulaire est décrite à l’aide d’une fonction level-set dont le mouvement est dû au gradient d’un signal chimique. Le modèle consiste en un couplage  à travers la membrane entre une phase interne (le signal chimique) et une phase externe (la dégradation de la matrice extracellulaire). La vitesse de la frontière libre est proportionnelle au gradient du signal intérieur, ce qui génère des difficultés à la fois théoriques et numériques. Bien que simpliste, notre modélisation présente des avantages par rapport aux modélisations existantes, notamment car la vitesse de formation de la protrusion n’est pas donnée a priori mais résulte du modèle. Un travail à long terme consisterait à enrichir ce modèle de la cascade de réactions chimiques intra-cellulaires générant le signal.

    • TBA
      Marc Cuggia et Guillaume Bouzillé (Université Rennes 1)
      Thursday, September 8, 2016 – 10:30
      Room Aurigny
      Talk abstract: 

      TBA

    • BWT-based indexing structure for metagenomic classification
      Karel Brinda (Université de Marne-la-Vallée)
      Thursday, July 7, 2016 – 10:30
      Room Aurigny
      Talk abstract: 
      Metagenomics is a powerful approach to study genetic content of environmental samples, which has been strongly promoted by NGS technologies. One of the main tasks is the assignment of reads of a metagenome to taxonomic units, and the subsequent abundance estimation. Most of recently developed programs for this task (such as LMAT, KRAKEN, KALLISTO) perform the assignment based on shared k-mers between reads and references. In such an approach, two major algorithmic subproblems can be distinguished: designing a k-mer index for a huge database of reference genomes and a given taxonomic tree, and designing an algorithm for assigning reads to taxonomic units from information on shared k-mers. In this talk, we consider the problem of index design and present a novel data structure that provides a full list of genomes containing a queried k-mer. The structure is based on BWT-index applied to sequences encoding k-mers proper to each node of the taxonomic tree. We analyse the usefulness of this index and evaluate it in terms of speed and memory requirements.
       
       
    • Parallel Shortest-Path Queries in Planar Graphs
      Hristo N. Djidjev (Los Alamos National Laboratory)
      Thursday, June 23, 2016 – 10:30
      Room Aurigny
      Talk abstract: 
      The query version of the shortest path problem allows the user to precompute information in the form of a data structure that would allow subsequently, when given any pair of vertices, to compute the shortest path between them very fast. It has been used in route-planning services such as Google Maps. We develop several parallel algorithms for shortest path queries in planar graphs that use graph partitioning in the preprocessing phase to precompute and store distances between selected pairs of vertices. In the query phase, given a pair of arbitrary vertices v and w, the stored information is used to find the distance between them. The algorithms are implemented and tested on a high performance cluster with upto 256 16-core CPUs and their performances are analyzed and compared.
       
       
    • Modifications du génome et de l’épigénome dans le lymphocyte B et la cellule stromale en réponse à l’antigène
      Karin Tarte & Thierry Fest
      Thursday, June 16, 2016 – 10:30
      Room Aurigny
      Talk abstract: 

      • Etude d’un réseau toxico-génomique pondéré en vue de la prédiction in-silico de la toxicité des substances chimiques
        Emmanuelle Becker
        Thursday, June 9, 2016 – 10:30
        Room Aurigny
        Talk abstract: 

        L’Union Européenne a récemment coordonné une campagne de recensement
        ayant dénombré plus de 100 000 substances dont seulement 3% ont fait
        l’objet d’analyses approfondies pour en évaluer la toxicité et établir
        des liens avec des pathologies humaines et des phénotypes délétères.
        Suite à ce constat, elle a depuis 2007 mis en place le programme
        Registration, Evaluation, Authorization of CHemicals (REACH), qui
        impose aux industriels produisant ou important des produits chimiques
        sur le territoire européen d’évaluer leur toxicité et de démontrer
        l’innocuité de ceux-ci . Parmi les différentes approches qui existent
        pour évaluer la toxicité d’une substance, l’utilisation de modèles
        animaux (in vivo ou ex vivo) reste la plus utilisée. Cependant, cette
        approche n’est pas optimale pour plusieurs raisons : (i) il existe des
        différences entre ces organismes modèles et l’homme; (ii) ces
        techniques sont onéreuses et relativement complexes à mettre en place
        ; et enfin (iii) le nombre d’animaux à sacrifier pour mener à bien ces
        études est extrêmement important.
        La prise en compte simultanée de l’ampleur du défi que représente
        l’investigation toxicologique de milliers de composés, et de leurs
        potentiels mélanges, ainsi que la complexité et le coût des approches
        in vivo, ex vivo et in vitro existantes, pousse les législateurs et
        scientifiques à considérer les approches prédictives in silico comme
        des compléments pertinents aux approches expérimentales.
        L’objectif serait ici de développer une méthode permettant une
        caractérisation fine de la toxicité, qui permette de différencier les
        différents types de toxicité (nephrotoxicité, neurotoxicité,
        reprotoxicité…) en se basant sur la signature toxico-génomique du
        composé. La signature toxico-génomique se définit par l’ensemble des
        gènes différentiellement exprimés suite à une exposition. Dans un
        premier temps, nous décrirons les données utilisées ainsi que leur
        traitement en vue d’aboutir à une matrice de signatures
        toxico-génomiques. Nous présenterons ensuite la construction d’un
        réseau pondéré de signatures toxico-génomiques, et étudierons quelques
        propriétés de celui-ci. Enfin, nous nous intéresserons à la modularité
        au sein de ce réseau, avant de tester la pertinence du transfert
        d’annotations de toxicité via les modules de ce réseau.

      • Inférence et interrogation de réseaux biologiques
        Mohamed Elati
        Thursday, May 12, 2016 – 10:30
        Room Aurigny
        Talk abstract: 
        Inférer et interroger (extraire de la connaissance) de réseaux biologiques, guidés par des données de type omics, est actuellement un domaine de recherche actif avec de nombreuses applications en biologie systémique et synthétique. L’apprentissage automatique avec son large éventail de techniques joue un rôle majeur, impliquant le développement des méthodologies “cas par cas”. 
        Dans cet exposé, je présenterai des outils pour i) inférer des réseaux de régulation des gènes, y compris leurs motifs cis-régulateurs; ii) estimer l’activité des facteurs de transcription et iii) extraire de modules fonctionnels. J’illustre mon propos par des exemples de projets en cours dans l’équipe.
      • TBA
        Caroline Baroukh
        Thursday, April 28, 2016 – 10:30
        Room Aurigny
        Talk abstract: 

        TBA

      • Contrôle de l’homéostasie protéique dans le réticulum endoplasmique dans les pathologies inflammatoires et néoplasiques
        Éric Chevet
        Thursday, April 21, 2016 – 10:30
        Room Aurigny
        Talk abstract: 
        – qu’est ce que l’homéostasie protéique

        – qu’est ce que le réticulum endoplasmique (RE)

        – les acteurs de l’homéostasie protéique dans le RE

        – un exemple avec AGR2, un membre de la famille des protein disulfide isomerases.

        – AGR2 dans le RE, AGR2 sécrété – inflammation et cancer.

         
      • Scalable Design Space Exploration via Answer Set Programming Modulo Theory
        Philipp Wanko
        Thursday, March 31, 2016 – 10:30
        Room Aurigny
        Talk abstract: 
        The complexity of multi-core processors increases more and more. In the 
        next generations, networks on chips (NOC) will be utilized which place 
        several possibly heterogeneous processing units in a network that work 
        together to run applications. This poses new design challenges like 
        binding tasks to fitting resources on the network, route messages 
        between the tasks and schedule the tasks to fulfill real-time 
        requirements. Ultimately, the resulting design should also be optimal 
        regarding quality measures like latency, costs and energy consumption. 
        Answer Set Programming (ASP) is well suited to accommodate routing and 
        binding since it is efficient for combinatorial problems and 
        reachability can be easily expressed. Scheduling and optimization of 
        numerical values on the other hand can not be efficiently encoded.
        We propose a system that uses new theory propagation capabilities to 
        combine ASP modulo several background theories to account for binding, 
        routing, scheduling and optimization at the same time. Customizable 
        theory languages allow us to define the complete system specification in 
        a declarative way.
        
      • Theory Solving made easy with Clingo 5
        Torsten Schaub (Uni. Potsdam)
        Thursday, March 24, 2016 – 10:30
        Room Aurigny
        Talk abstract: 

        We present the fifth generation of the ASP systems gringo\ and clingo,
        while focusing on their major feature, namely, the easy addition of theory reasoning.
        From the grounder’s perspective, this involves a generic way of specifying theory-specific language
        extensions and the design of an intermediate format accommodating ground theory expressions.
        From the solving view, this is accompanied by a high-level interface for integrating theory propagators
        interpreting these theory expressions.

        (This will be rather a demo than a talk! )

      • Oxford Nanopore Technology : Données et applications.
        Jean Marc Aury (Genoscope)
        Thursday, March 10, 2016 – 10:30
        Room Aurigny
        Talk abstract: 

        La société Oxford Nanopore Technology - ONT (https://www.nanoporetech.com/) propose depuis peu un séquenceur 3ème génération, permettant de lire de très grands fragments d'ADN, jusqu'à 100Kb. La technique de séquençage par Nanopore est très différentes des technologies existantes et elle présente de nombreux avantages. L'exposé présentera le fonctionnement du séquenceur MkI de ONT, ainsi que différents jeux de données obtenus sur des bactéries et des eucaryotes. Par le biais de séquençage d'ADN génomique, nous illustrerons l'intérêt du séquenceur MkI pour l'assemblage de novo de génomes et notamment la résolution des régions répétées.
         

      • Applications of the Theory of Formal Languages for the Design of Fast Hardware Implementations of Parallel Multiset Rewriting
        Serghei Verlan (LACL Université Paris Est Créteil Val de Marne )
        Thursday, March 3, 2016 – 10:30
        Room Aurigny
        Talk abstract: 

        In this talk we present the design of a fast hardware simulator forparallel multiset rewriting using the field-programmable gate array(FPGA) technology. The simulator is non-deterministic and it uses aconstant time procedure to choose one of the computational paths. Theobtained strategy is equitable and it is based on a pre-computation ofall possible rule applications. This pre-computation is obtained byusing the representation of all possible multisets of rules’applications as context-free languages. Then using the Schutzenbergertechnique for the computation of the generating series for context-freelanguages it is possible to construct the structure representing allpossible rule applications for any configuration.We give a hardware design implementing some concrete examples andpresent the obtained experimental results which feature an importantspeed-up. 

      • Identification et « quantification » des attracteurs dans des dynamiques discrètes asynchrones. Application sur un modèle de cancer de vessie.
        Elisabeth Remy (université d’Aix-Marseille)
        Thursday, January 28, 2016 – 10:30
        Room Aurigny
        Talk abstract: 
         
        Le cadre de cet exposé est la modélisation discrète des réseaux de régulation biologique. 
        La formalisme logique permet de faire une analyse qualitative de la dynamique des processus étudiés, et de proposer une explication « mécanistique » des phénomènes observés.
        Après une description de ce formalisme et des principaux outils qui permettent d’analyser les propriétés du système, nous étudierons une application de cette modélisation dans le cadre de la tumorigénèse du cancer de vessie. Plus précisément, nous portons notre attention sur les co-occurences ou exclusions mutuelles d’altérations génétiques qui apparaissent de façon significative. 
        Pour expliquer ces pattern d’altérations, une exploration plus quantitative de la dynamique s’avère nécessaire. Ainsi, nous  proposons une méthode pour quantifier l’atteignabilité des attracteurs dans des (très) grands graphes.
         
      • Approximating the dynamics of the Hybrid Stochastic-Deterministic Apoptosis pathway
        Sucheendra Palaniappan (Inria Rennes)
        Thursday, January 21, 2016 – 10:30
        Room Aurigny
        Talk abstract: 

        Modeling and analysis of the dynamics of biological systems while accounting for single cell fluctuations is important. In particular, there has been recent work on a hybrid stochastic-deterministic (HSD) model of TRAIL induced apoptosis that combines a deterministic signal transduction model and a stochastic model for protein turnover that can explain fractional killing and predict the time dependent evolution of cell resistance to TRAIL. While this model is extremely useful for analyzing TRAIL induced apoptosis by drawing simulations in a single cell setting, it can be limiting in cases when we want to analyse the system in a multi-scale setting (say modeling a spheroid of millions of cells at larger time horizon for clinical trials).In such cases, simulating the original model for repeated analysis tasks can become extremely time consuming due to the scale of the resultant system. Instead, one could directly approximate the dynamics of the underlying system as an intermediate level behavioral model and use this approximation instead. In this talk, we will present results describing a minimalist discrete appromixation (Dynamic Bayesian Networks (DBNs) ) of the dynamics of the HSD model. We will describe how analysis tasks on the original HSD model translates to probabilistic inference tasks on the DBN. 

         

      • L’hétérozygotie, problème technique ou objet d’étude ?
        Jean-François Flot (Evolutionary Biology & Ecology – Université Libre de Bruxelles)
        Thursday, January 14, 2016 – 10:30
        Room Aurigny
        Talk abstract: 

        Dans les études de phylogénie et de génomique il est courant de considérer l’hétérozygotie des organismes diploïdes comme un problème nuisible dont on cherche à se débarrasser afin d’obtenir des données exploitables. Si les séquences obtenues à partir d’individus hétérozygotes sont certes complexes, elles renferment néanmoins des trésors d’informations hélas trop peu souvent exploitées. A partir d’exemples divers (notamment coraux, amphipodes et rotifères), j’illustrerai certaines approches bioinformatiques permettant de tirer partie de l’hétérozygotie des organismes pour jeter un regard nouveau sur l’évolution et sur la dynamique de leur génome. 

         

      • L’assemblage de grands génomes à base des séquence PacBio vu des données
        Christophe Klopp
        Thursday, January 7, 2016 – 10:30
        Room Aurigny
        Talk abstract: 

        L’assemblage de génomes de grande taille est, depuis les débuts de la génomique, un sujet de grand intérêt pour les biologistes et de recherche pour les informaticiens. Une première génération d’assembleurs de type OLC (overlap layout consensus) a été développée pour le traitement des séquences de première génération appelées aussi séquences Sanger. La stratégie était alors le plus souvent de découper le génomes en morceaux (fosmides, BAC) et d’assembler les lectures provenant de ces morceaux avant de joindre ces premiers assemblages pour produire des morceaux de chromosomes. La diminution du coût de séquençages due à l’apparition des machines de seconde génération a poussé au développement de nouveaux algorithmes, souvent basés sur des graphes de de Bruinj, capables de traiter ces grandes masses de données. La troisième génération de séquenceurs est maintenant entrée dans une phase de maturité avec la capacité de produire d’assez grandes quantités de séquences très longues. Ceci remet en selle la première stratégie d’assemblage et certaines suites logicielles anciennes ayant été adaptées à ces nouvelles données. Les séquences étant de très faible qualité, il a toutefois été nécessaire d’ajouter une étape de correction en amont de l’assemblage. L’exposé présente l’évolution des stratégies d’assemblage en faisant un focus sur celles utilisant les séquences de troisième génération. l’évolution de la qualité des séquences aux différentes étapes de l’assemblage permettra de montrer impact de la correction mais aussi ses limites actuelles. L’exposé comprend des exemples issus d’assemblages de données publiques ou privées afin d’analyser à chaque étape la qualité des données en entrée et en sortie de manière à aussi trouver de possibles améliorations du processus.

         

 

see year: 2020201920182017 – 2016 – 2015201420132012