Accessibility Tools

- Le blog participatif de bioinformatique francophone depuis 2012 -

Qui sommes nous ?

Une communauté d'étudiants et de professionnels

Une base d'articles libres pour tous niveaux

Des salons de discussion actifs au quotidien

  • Les matrices de substitution

    Les matrices de substitution

    Dans les premiers billets de ce blog, nous avons présenté les alignements multiples de séquences d'une part du point de vue des logiciels et ensuite du calcul de la conservation. Je vous propose aujourd'hui de revenir sur un point important : les matrices de substitution. Commençons par une définition très simple : une matrice de substitution permet, pour chaque acide aminé, de connaître sa capacité à être substitué par chaque autre acide aminé, y compris lui-​même. Cette définition ne nous dit pas comment est déterminée la "capacité à être substitué" d'un acide aminé… c'est d'ailleurs là toute la question qui anime ce…

    Lire la suite : Les matrices de substitution
  • Introduction aux pipelines

    Introduction aux pipelines

    Il vous est peut-​être arrivé d'attendre qu'un logiciel A ait fini son travail pour pouvoir lancer un logiciel B, qui lui utilise la sortie du logiciel A. Si l'exécution de A ne prend que quelques secondes cela n'est pas trop grave. Par contre, si elle prend des heures et que vous devez vérifier régulièrement s’il a fini, cela peut très vite devenir fatigant. Une bonne solution serait de faire que le logiciel B s'exécute automatiquement quand A a fini et c'est cela que l'on appelle un pipeline. Aujourd'hui je vais éclaircir pour vous ce terme et donner quelque exemples, très…

    Lire la suite : Introduction aux pipelines
  • Astuce : ajouter des options dans un script Bash avec getopt

    Astuce : ajouter des options dans un script Bash avec getopt

    But : comprendre le fonctionnement de getopt en Bash pour éviter la multiplications de script là où un seul générique pourrait suffire. Prérequis : savoir faire des scripts Bash, connaître la substitution de commande et savoir manipuler les arguments. Difficulté : 2 (moyen) Pour ceux qui codent en Perl, vous connaissez déjà sûrement le module GetOpt et plus particulièrement son extension GetOpt::Long (ou encore le module getopt du langage Python). Mais pour ceux qui souhaitent juste faire un script qui enchaine les grep et les cut pour pouvoir compter le nombre d'occurence d'une clé en fonction de certains critères, il peut être utile…

    Lire la suite : Astuce : ajouter des options dans un script Bash avec getopt
  • Travailler avec des bases de données publiques

    Travailler avec des bases de données publiques

    Dans un précédent article, intitulé "Base de données - notions" de nahoy, nous vous avons présenté ce qu'est une base de données et le principe de fonctionnement. Si vous n'avez aucune notion en base de données, ou si vous souhaitez une piqûre de rappel, je vous invite chaudement à lire cet excellent article avant de passer à la suite 🙂 ! Ici je ne vous parlerais pas d'une base de données en particulier mais plus des bases de données publiques. Je tâcherai de vous présenter quel intérêt ces bases de données peuvent présenter, sur quels critères on peut se baser pour…

    Lire la suite : Travailler avec des bases de données publiques
  • Métagénomique et Graphique de Recrutement : chercher l'aiguille dans la botte de foin !

    Métagénomique et Graphique de Recrutement : chercher l'aiguille dans la botte de foin !

    Un intérêt certain se développe pour la compréhension d'écosystèmes complexes comme les eaux, les sols ou encore les microbiomes (plus de 90% des cellules du corps humain sont en fait les bactéries qui peuplent son tube digestif). Plusieurs difficultés se posent : Face à une tâche aussi ingrate que passionnante, les chercheurs ont trouvé une solution dans la célèbre phrase associée à la Croisade des Albigeois : « Tuez-​les tous, Dieu reconnaîtra les siens », en l'adaptant légèrement : « Séquencez-​les tous, un doctorant fera le tri » Ainsi naquît la Métagénomique et de grands projets comme le séquençage du rumen des vaches ou du microbiome humain,…

    Lire la suite : Métagénomique et Graphique de Recrutement : chercher l'aiguille dans la botte de foin !
  • Cours de R pour débutant pressé (introduction)

    Cours de R pour débutant pressé (introduction)

    Bonjour à tous ! Aujourd’hui, je vous propose un premier petit cours/​tutoriel de niveau « débutant », d’une série d’au moins 3, pour apprendre à faire quelques graphiques avec R et vous la péter devant vos collègues encore à grapher sous Excel. Ce tutoriel s’adresse aux gens qui n’ont jamais codé, qui ne connaissent pas grand-​chose à la programmation et qui sont avides de savoir/​pouvoir (les deux choses étant liées). Donc si vous êtes non-​bioinformaticien sympathisant, ou que vous passez là par pur hasard, ce tuto est pour vous ! De plus, j’ai dans l’idée de m’efforcer à faire des cours condensés, qui ne…

    Lire la suite : Cours de R pour débutant pressé (introduction)
  • Comment organiser sa veille en Bioinformatique ?

    Librement traduit, complété et adapté de l’article “How to Stay Current in Bioinformatics/​Genomics” par Stephen Turner. Stephen est "assistant professor" (c'est à dire professeur non encore titularisé) en santé publique, et directeur du bioinformatics core de l'Université de Virginie, et tient le blog Getting Things Done in Genetics & Bioinformatics Research. Plusieurs personnes ayant demandé à Stephen comment il restait au courant de ce qu’il se passait dans son domaine, il a décidé de partager sa stratégie sur son blog. Avec une immensité de sources à disposition, la difficulté n’est pas vraiment de trouver ce qui est intéressant, mais plutôt de filtrer ce qui ne…

    Lire la suite : Comment organiser sa veille en Bioinformatique ?
  • Une question d'équilibre

    Une question d'équilibre

    De nombreux articles de bioinformatique commencent par une phrase du genre : "Les multiples projets de séquençage et les progrès technologiques réalisés ces dernières années permettent aujourd'hui de produire une énorme masse de données biologiques." Cette phrase sert en général à introduire l'utilisation d'algorithme plus rapide, le traitement en parallèle des données, ou leur utilisation massive afin d'extraire de la connaissance. Mais au-​delà de ces trois thèmes, le traitement ou l'utilisation de grande quantité de données impose de réfléchir un petit peu plus précisément à l'équilibre entre temps de calcul et temps de lecture/​écriture, voire même à remettre en cause la complexité théorique d'un algorithme. C'est…

    Lire la suite : Une question d'équilibre

Articles les plus lus ces 7 derniers jours

Utilisateur/utilisatriceUtilisateur/utilisatrice4 juin 2024Les admin·e·s
Salons de discussionSalons de discussion4 janvier 2024I. Stévant