Échantillonnage (statistiques)thumb|Exemple d'échantillonnage aléatoire En statistique, l'échantillonnage désigne les méthodes de sélection d'un sous-ensemble d'individus (un échantillon) à l'intérieur d'une population pour estimer les caractéristiques de l'ensemble de la population. Cette méthode présente plusieurs avantages : une étude restreinte sur une partie de la population, un moindre coût, une collecte des données plus rapide que si l'étude avait été réalisé sur l'ensemble de la population, la réalisation de contrôles destructifs Les résultats obtenus constituent un échantillon.
Base de données orientée documentsUne base de données orientée documents est une base de données destinée aux applications qui gèrent des documents. Egalement nommée "magasin de documents", c'est un programme informatique et un système de stockage de données conçu pour stocker, récupérer et gérer des informations orientées documents, également appelées données semi-structurées. Ce type de bases de données peut être une sur-couche d'une base de données relationnelle ou non. C'est également l'une des principales catégories de bases de données NoSQL.
Voie métaboliqueUne voie métabolique est un ensemble de réactions chimiques catalysées par une série d'enzymes qui agissent de manière séquentielle. Chaque réaction constitue une étape d'un processus complexe de synthèse ou de dégradation d'une molécule biologique finale. Dans une voie métabolique, le produit de la réaction catalysée par une enzyme sert de substrat pour la réaction suivante. Les voies métaboliques peuvent être linéaires, ramifiées (ou branchées), voire cycliques.
Shard (database architecture)A database shard, or simply a shard, is a horizontal partition of data in a database or search engine. Each shard is held on a separate database server instance, to spread load. Some data within a database remains present in all shards, but some appear only in a single shard. Each shard (or server) acts as the single source for this subset of data. Horizontal partitioning is a database design principle whereby rows of a database table are held separately, rather than being split into columns (which is what normalization and vertical partitioning do, to differing extents).
Protéine de fusionUne protéine de fusion est une protéine artificielle obtenue par la combinaison de différentes protéines, ou partie de protéines. Elle est obtenue à la suite de la création par recombinaison de l'ADN d'un gène comportant les cadres de lecture ouverts correspondant aux protéines ou parties de protéines désirées. Les protéines de fusion peuvent également être appelées protéines chimères. Une des applications les plus connues des protéines de fusion est la fusion d'une protéine d'intérêt à une protéine fluorescente.
Adressage des protéinesDans une cellule, la localisation d'une protéine est essentielle à son bon fonctionnement. Or le lieu de production d'une protéine est souvent différent de son lieu d'action. L'adressage est l'ensemble des mécanismes qui permettent à une protéine d'être dirigée vers la bonne position. Les ARNm sont sujet à un adressage. Günter Blobel, biologiste moléculaire germano-américain, a obtenu le Prix Nobel de physiologie ou médecine en 1999 pour ses travaux sur la NLS (nuclear localisation signal), une séquence en acides aminés permettant aux protéines qui la portent d'être importée dans le noyau grâce à des importines.
UniProtUniProt est une base de données de séquences de protéines. Son nom dérive de la contraction de Universal Protein Resource (base de données universelle de protéines). C'est une base de données ouverte, stable et accessible en ligne, elle est issue de la consolidation de l'ensemble des données produites par la communauté scientifique. UniProt est une base annotée, hiérarchisée où chaque séquence est accompagnée d'un ensemble riche de métadonnées et de liens vers de nombreuses autres bases de données : bibliographiques, phylogénétiques, nucléotidiques.
ProtéomeLe protéome est l'ensemble des protéines exprimées dans une cellule, une partie d'une cellule (membranes, organites) ou un groupe de cellules (organe, organisme, groupe d'organismes) dans des conditions données et à un moment donné. Ce terme d'origine anglo-saxonne a été inventé en 1994 par Mark Wilkins de l'Université Macquarie de Sydney. Il provient de la contraction de protéine et génome car le protéome est aux protéines ce que le génome est pour les gènes.
Super-famille de protéinesUne superfamille (ou super-famille) de protéines est le regroupement le plus large (clade) de protéines pour lesquelles il est possible d'identifier un ancêtre commun par homologie. Cet ancêtre commun est généralement déduit par et similitude mécanique, même lorsque aucune similitude entre les séquences n'est détectable. Les super-familles contiennent généralement plusieurs familles de protéines présentant des similitudes de séquences au sein de ces familles.
Convenience samplingConvenience sampling (also known as grab sampling, accidental sampling, or opportunity sampling) is a type of non-probability sampling that involves the sample being drawn from that part of the population that is close to hand. This type of sampling is most useful for pilot testing. Convenience sampling is not often recommended for research due to the possibility of sampling error and lack of representation of the population. But it can be handy depending on the situation. In some situations, convenience sampling is the only possible option.
MétabolismeLe métabolisme est l'ensemble des réactions chimiques qui se déroulent à l'intérieur de chaque cellule d'un être vivant et lui permettent notamment de se maintenir en vie, de se reproduire (se diviser), de se développer et de répondre aux stimuli de son environnement (échanges par exemple). Certaines de ces réactions chimiques se déroulent en dehors des cellules de l'organisme, comme la digestion ou le transport de substances entre cellules. Cependant, la plupart de ces réactions ont lieu dans les cellules elles-mêmes et constituent le métabolisme intermédiaire.
Chromatographie en phase gazeuse-spectrométrie de masseLa chromatographie en phase gazeuse couplée à la spectrométrie de masse, abrégé CPG-SM, ou GC-MS de l'anglais Gas chromatography-mass spectrometry, est une technique d'analyse qui combine les performances de la chromatographie en phase gazeuse, pour la séparation des composés d'un échantillon, et de la spectrométrie de masse, pour la détection et l’identification des composés en fonction de leur rapport masse sur charge. Cette technique permet d'identifier et/ou de quantifier précisément de nombreuses substances présentes en très petites quantités, voire en traces.