Qui sommes nous ?
-
Les matrices de substitution
Lire la suite : Les matrices de substitutionDans les premiers billets de ce blog, nous avons présenté les alignements multiples de séquences d'une part du point de vue des logiciels et ensuite du calcul de la conservation. Je vous propose aujourd'hui de revenir sur un point important : les matrices de substitution. Commençons par une définition très simple : une matrice de substitution permet, pour chaque acide aminé, de connaître sa capacité à être substitué par chaque autre acide aminé, y compris lui-même. Cette définition ne nous dit pas comment est déterminée la "capacité à être substitué" d'un acide aminé… c'est d'ailleurs là toute la question qui anime ce…
-
Introduction aux pipelines
Lire la suite : Introduction aux pipelinesIl vous est peut-être arrivé d'attendre qu'un logiciel A ait fini son travail pour pouvoir lancer un logiciel B, qui lui utilise la sortie du logiciel A. Si l'exécution de A ne prend que quelques secondes cela n'est pas trop grave. Par contre, si elle prend des heures et que vous devez vérifier régulièrement s’il a fini, cela peut très vite devenir fatigant. Une bonne solution serait de faire que le logiciel B s'exécute automatiquement quand A a fini et c'est cela que l'on appelle un pipeline. Aujourd'hui je vais éclaircir pour vous ce terme et donner quelque exemples, très…
-
Astuce : ajouter des options dans un script Bash avec getopt
Lire la suite : Astuce : ajouter des options dans un script Bash avec getoptBut : comprendre le fonctionnement de getopt en Bash pour éviter la multiplications de script là où un seul générique pourrait suffire. Prérequis : savoir faire des scripts Bash, connaître la substitution de commande et savoir manipuler les arguments. Difficulté : 2 (moyen) Pour ceux qui codent en Perl, vous connaissez déjà sûrement le module GetOpt et plus particulièrement son extension GetOpt::Long (ou encore le module getopt du langage Python). Mais pour ceux qui souhaitent juste faire un script qui enchaine les grep et les cut pour pouvoir compter le nombre d'occurence d'une clé en fonction de certains critères, il peut être utile…
-
Travailler avec des bases de données publiques
Lire la suite : Travailler avec des bases de données publiquesDans un précédent article, intitulé "Base de données - notions" de nahoy, nous vous avons présenté ce qu'est une base de données et le principe de fonctionnement. Si vous n'avez aucune notion en base de données, ou si vous souhaitez une piqûre de rappel, je vous invite chaudement à lire cet excellent article avant de passer à la suite 🙂 ! Ici je ne vous parlerais pas d'une base de données en particulier mais plus des bases de données publiques. Je tâcherai de vous présenter quel intérêt ces bases de données peuvent présenter, sur quels critères on peut se baser pour…
-
Cours de R pour débutant pressé (introduction)
Lire la suite : Cours de R pour débutant pressé (introduction)Bonjour à tous ! Aujourd’hui, je vous propose un premier petit cours/tutoriel de niveau « débutant », d’une série d’au moins 3, pour apprendre à faire quelques graphiques avec R et vous la péter devant vos collègues encore à grapher sous Excel. Ce tutoriel s’adresse aux gens qui n’ont jamais codé, qui ne connaissent pas grand-chose à la programmation et qui sont avides de savoir/pouvoir (les deux choses étant liées). Donc si vous êtes non-bioinformaticien sympathisant, ou que vous passez là par pur hasard, ce tuto est pour vous ! De plus, j’ai dans l’idée de m’efforcer à faire des cours condensés, qui ne…
-
Comment organiser sa veille en Bioinformatique ?
Lire la suite : Comment organiser sa veille en Bioinformatique ?Librement traduit, complété et adapté de l’article “How to Stay Current in Bioinformatics/Genomics” par Stephen Turner. Stephen est "assistant professor" (c'est à dire professeur non encore titularisé) en santé publique, et directeur du bioinformatics core de l'Université de Virginie, et tient le blog Getting Things Done in Genetics & Bioinformatics Research. Plusieurs personnes ayant demandé à Stephen comment il restait au courant de ce qu’il se passait dans son domaine, il a décidé de partager sa stratégie sur son blog. Avec une immensité de sources à disposition, la difficulté n’est pas vraiment de trouver ce qui est intéressant, mais plutôt de filtrer ce qui ne…
-
Une question d'équilibre
Lire la suite : Une question d'équilibreDe nombreux articles de bioinformatique commencent par une phrase du genre : "Les multiples projets de séquençage et les progrès technologiques réalisés ces dernières années permettent aujourd'hui de produire une énorme masse de données biologiques." Cette phrase sert en général à introduire l'utilisation d'algorithme plus rapide, le traitement en parallèle des données, ou leur utilisation massive afin d'extraire de la connaissance. Mais au-delà de ces trois thèmes, le traitement ou l'utilisation de grande quantité de données impose de réfléchir un petit peu plus précisément à l'équilibre entre temps de calcul et temps de lecture/écriture, voire même à remettre en cause la complexité théorique d'un algorithme. C'est…
Articles les plus lus ces 7 derniers jours
Les salons de discussion :



La boutique

Quelques liens
Étiquettes
ADN analyse base de données bioinformatique code concours conférence débutant Découverte edito emploi formation Génomique Interview JeBiF JOBIM master modélisation outil programmation Python R Recherche rentrée script SFBI statistiques séquençage tutoriel vacances visualisation








