Biostatistique - Test
  • 1. La biostatistique est une branche de la statistique qui traite des données relatives aux organismes vivants. Elle implique la conception, l'analyse et l'interprétation des données dans des domaines tels que la biologie, la médecine, la santé publique et les sciences de l'environnement. La biostatistique joue un rôle crucial dans les études de recherche, les essais cliniques et les initiatives de santé publique en fournissant des méthodes statistiques pour analyser les données, tirer des conclusions et prendre des décisions éclairées. Elle permet de comprendre les caractéristiques des maladies, d'identifier les facteurs de risque, d'évaluer les interventions thérapeutiques et de prédire les résultats en matière de santé. Les biostatisticiens utilisent leur expertise en matière de théorie et de méthodes statistiques pour répondre à des questions de recherche complexes et contribuer aux progrès de la science et de la politique de la santé.

    Quel est l'objectif des tests d'hypothèse en biostatistique ?
A) Pour estimer la moyenne de la population.
B) Déterminer s'il y a suffisamment de preuves pour rejeter une hypothèse nulle.
C) Prouver une hypothèse avec une certitude de 100 %.
D) Pour calculer l'écart-type.
  • 2. Dans un essai clinique, quel est le rôle d'un groupe de contrôle ?
A) Administrer le traitement aux participants.
B) Analyser les résultats.
C) Fournir une base de référence pour la comparaison avec le groupe de traitement.
D) Recueillir des données auprès des participants.
  • 3. Quel type d'étude est le mieux adapté pour déterminer les relations de cause à effet ?
A) Étude transversale
B) Étude d'observation
C) Étude cas-témoins
D) Essai contrôlé randomisé
  • 4. Qu'est-ce que la sensibilité dans le contexte des tests de diagnostic ?
A) La proportion de vrais résultats négatifs parmi tous les individus ne présentant pas la maladie.
B) La proportion de résultats faussement positifs.
C) La proportion de vrais résultats positifs parmi toutes les personnes atteintes de la maladie.
D) La proportion de résultats faussement négatifs.
  • 5. Que signifie la valeur p dans les tests d'hypothèse ?
A) La taille de l'échantillon nécessaire à l'étude.
B) La probabilité d'obtenir des résultats aussi extrêmes que les résultats observés, en supposant que l'hypothèse nulle est vraie.
C) La force de la relation entre les variables.
D) L'intervalle de confiance de l'estimation.
  • 6. Quel type de technique d'échantillonnage divise une population en sous-groupes et échantillonne ensuite chaque sous-groupe ?
A) Échantillonnage aléatoire simple
B) Échantillonnage systématique
C) L'échantillonnage en grappe
D) Échantillonnage stratifié
  • 7. Quel est l'objectif de l'analyse de régression ?
A) Explorer la relation entre une variable dépendante et une ou plusieurs variables indépendantes.
B) Pour calculer les probabilités.
C) Déterminer la tendance centrale.
D) Pour estimer les paramètres de la population.
  • 8. Quel test statistique peut être utilisé pour comparer les moyennes de plus de deux groupes ?
A) ANOVA
B) Test t à deux échantillons
C) Test du chi carré
D) Test t par paires
  • 9. Comment appelle-t-on également la biostatistique ?
A) Biomatémathématiques
B) Biomécanique
C) Bio-informatique
D) Biométrie
  • 10. Quel domaine est étroitement lié à la statistique médicale ?
A) Pathologie
B) Pharmacologie
C) Biostatistique
D) Épidémiologie
  • 11. Qui a initié les études en génétique en étudiant les schémas de transmission des caractères dans les familles de pois ?
A) Francis Galton
B) William Bateson
C) Gregor Mendel
D) Charles Darwin
  • 12. Qui a fortement désapprouvé les idées de Galton sur l'hérédité ?
A) Raphael Weldon
B) Karl Pearson
C) William Bateson
D) Arthur Dukinfield Darbishire
  • 13. Quel groupe a soutenu les idées de Mendel sur l'hérédité génétique ?
A) Les néo-darwinistes
B) Les darwinistes
C) Les mendéliens
D) Les biométriciens
  • 14. Qui a développé les concepts de l'ANOVA (analyse de la variance) et de la valeur p ?
A) J. B. S. Haldane
B) Ronald Fisher
C) Betty Allan
D) Sewall G. Wright
  • 15. Qui a développé les statistiques F et les méthodes de calcul de celles-ci ?
A) J. B. S. Haldane
B) Ronald Fisher
C) Betty Allan
D) Sewall G. Wright
  • 16. Quel mécanisme de l'évolution le livre de J. B. S. Haldane a-t-il réaffirmé comme étant le principal ?
A) Mutation
B) Sélection naturelle
C) Dérive génétique
D) Flux génétique
  • 17. Qui a interdit l'utilisation de la calculatrice Friden dans son département au Caltech ?
A) Sewall G. Wright
B) J. B. S. Haldane
C) Ronald Fisher
D) Thomas Hunt Morgan
  • 18. Lequel des éléments suivants N'EST PAS un principe fondamental de la statistique expérimentale ?
A) Contrôle local
B) Répétition
C) Détermination de la taille de l'échantillon
D) Randomisation
  • 19. Quels éléments devraient guider la formulation d'une question de recherche ?
A) Une revue de la littérature exhaustive.
B) La conception de l'étude.
C) Les perspectives d'analyse des données.
D) Les considérations financières.
  • 20. Quelle composante de la planification de la recherche implique de définir comment poser une question scientifique ?
A) La conception expérimentale.
B) Les coûts associés.
C) La question de recherche.
D) Les perspectives d'analyse des données.
  • 21. Quel principe de la statistique expérimentale permet de réduire les biais ?
A) Contrôle local
B) Randomisation
C) Estimation des coûts
D) Répétition
  • 22. Selon le texte, quelle est la première étape pour définir une question de recherche ?
A) Estimer les coûts.
B) Réaliser une revue de la littérature exhaustive.
C) Déterminer les méthodes de collecte de données.
D) Élaborer la conception expérimentale.
  • 23. Quel logiciel est utilisé pour les calculs d'algèbre linéaire ?
A) SciPy
B) SageMath
C) NumPy
D) LAPACK
  • 24. Quelle distribution était initialement utilisée pour les données de comptage de l'analyse de l'expression génique à ARN (RNA-Seq), mais sous-estimait l'erreur de l'échantillon ?
A) Poisson
B) Binomiale négative
C) Binomiale
D) Normale
  • 25. Quels logiciels prennent en charge les dosages quantitatifs dans des environnements réglementés, tels que les tests pharmaceutiques ?
A) SAS
B) Weka
C) PLA 3.0
D) Apache Spark
  • 26. Quel fournisseur de services cloud est mentionné comme un outil d'analyse statistique des données biologiques ?
A) Microsoft Azure
B) Amazon Web Services
C) IBM Cloud
D) Google Cloud Platform
  • 27. Dans la formule du calcul de la moyenne arithmétique, que représente le symbole '∑' ?
A) Sommation
B) Différence
C) Produit
D) Division
  • 28. Quel symbole représente la moyenne arithmétique en notation mathématique ?
A) Σ
B) n
C) i
D) x̄
  • 29. Quel logiciel est un outil basé sur Java pour l'apprentissage automatique et l'exploration de données ?
A) SAS
B) R
C) Weka
D) Orange
  • 30. Quelle étape de la planification de la recherche consiste à déterminer comment collecter les données ?
A) Méthodes de collecte de données.
B) Formulation de la question de recherche.
C) Test des hypothèses.
D) Estimation des coûts.
  • 31. Dans un graphique linéaire, quel axe représente généralement le temps ?
A) Les deux axes représentent également le temps
B) L'axe horizontal
C) Le temps n'est pas représenté dans un graphique linéaire
D) L'axe vertical
  • 32. Quel langage de programmation est associé à l'apprentissage profond et à l'analyse d'images en bio-informatique ?
A) SQL
B) Python
C) R
D) SAS
  • 33. Quelle technique prend en compte la perturbation de groupes entiers de gènes plutôt que de gènes individuels ?
A) Séquençage de nouvelle génération
B) Analyse discriminante linéaire
C) Analyse d'enrichissement de groupes de gènes (GSEA)
D) Analyse en composantes principales
  • 34. Quelle est la formule pour calculer le nombre total d'observations (N) dans un tableau de fréquences ?
A) N = fi * N
B) N = fi / N
C) N = f1 + f2 + f3 + ... + fn
D) N = fi - N
  • 35. Sur quoi repose une étude d'association à l'échelle du génome (GWAS) ?
A) Lieux des gènes quantitatifs.
B) Fréquence de recombinaison.
C) Sélection génomique.
D) Déséquilibre de liaison.
  • 36. Quel logiciel permet d'estimer les composantes de variance dans le cadre d'un modèle linéaire mixte général en utilisant la méthode REML ?
A) ASReml
B) Orange
C) SAS
D) CycDesigN
  • 37. Dans quel domaine la conception et l'analyse des essais cliniques sont-elles particulièrement importantes ?
A) Génétique quantitative
B) Santé publique
C) Élevage animal
D) Médecine systémique
  • 38. Quelle méthode biostatistique permet de réduire la dimensionnalité en transformant les variables explicatives en un ensemble plus petit de composantes non corrélées ?
A) Régression linéaire
B) Régression logistique
C) Analyse d'enrichissement de gènes
D) Analyse en composantes principales
  • 39. Quels modèles statistiques sont utilisés pour effectuer des tests de signification statistique dans l'analyse des données de séquençage de l'ARN ?
A) Modèles de régression linéaire
B) Tests du chi-carré
C) Modèles linéaires généralisés
D) ANOVA (analyse de la variance)
  • 40. Qui a introduit les histogrammes en tant que représentation graphique ?
A) Karl Pearson
B) John Tukey
C) Francis Galton
D) Ronald Fisher
  • 41. Quel est un autre terme pour un nuage de points ?
A) Diagramme en barres
B) Diagramme de dispersion
C) Graphique linéaire
D) Diagramme circulaire
  • 42. Comment appelle-t-on aussi un nuage de points ?
A) Histogramme
B) Diagramme en barres
C) Nuage de points
D) Diagramme circulaire
  • 43. Comment une question de recherche bien définie bénéficie-t-elle à la communauté scientifique ?
A) En minimisant les coûts.
B) En simplifiant l'analyse des données.
C) En apportant de la valeur grâce à des perspectives nouvelles.
D) En réduisant le besoin de répétition des expériences.
  • 44. Quel type de graphique est le plus approprié pour illustrer les variations au fil du temps ?
A) Graphique linéaire
B) Diagramme en barres
C) Diagramme circulaire
D) Histogramme
  • 45. Que signifie une valeur de -1 pour le coefficient de corrélation de Pearson ?
A) Une corrélation négative parfaite
B) Une corrélation positive parfaite
C) Une relation indéfinie
D) Aucune corrélation linéaire
  • 46. Quel algorithme de cartographie n'est pas couramment utilisé dans la cartographie des QTL ?
A) Cartographie par intervalles
B) Aucune des réponses ci-dessus
C) Cartographie par intervalles multiples
D) Cartographie par intervalles composites
  • 47. Que représente un niveau de signification (α) dans les tests d'hypothèses ?
A) La probabilité que l'hypothèse nulle soit vraie.
B) Le taux d'erreur acceptable lors de la détermination de la signification statistique.
C) L'intervalle de valeurs pour un intervalle de confiance.
D) Le coefficient de corrélation entre deux variables.
  • 48. Quel outil est utilisé pour le traitement avancé des données, l'exploration de données et la visualisation ?
A) ASReml
B) CycDesigN
C) PLA 3.0
D) Orange
  • 49. Quelle base de données est dédiée à Arabidopsis thaliana ?
A) KEGG
B) TAIR
C) dbSNP
D) Phytozome
  • 50. Quel est l'objectif de la sélection assistée par des marqueurs ?
A) La cartographie des caractères quantitatifs.
B) Les résultats de l'élevage en agriculture.
C) Les systèmes d'aide à la décision clinique.
D) Les modèles de sélection génomique.
  • 51. Quel langage de programmation est connu pour son environnement open source et ses capacités de calcul statistique, avec des packages disponibles sur CRAN ?
A) MATLAB
B) Python
C) SQL
D) R
  • 52. Quelle base de données est axée sur les SNPs ?
A) dbSNP
B) PubMed
C) Ontologie génique
D) KEGG
  • 53. Quelle base de données stocke les assemblages et les fichiers d'annotation de dizaines de génomes de plantes ?
A) TAIR
B) Phytozome
C) KEGG
D) dbSNP
  • 54. Quelle base de données est utilisée pour l'indexation des articles scientifiques ?
A) KEGG
B) PubMed
C) dbSNP
D) Ontologie génique
  • 55. Quel terme désigne une forte intercorrélation entre les prédicteurs dans les contextes biostatistiques ?
A) Analyse d'enrichissement de gènes
B) Multicolinéarité
C) Réduction de la dimensionnalité
D) Analyse en composantes principales
  • 56. Quelle méthode biostatistique a gagné en popularité pour la classification statistique ?
A) Méthode de bootstrap
B) Arbres de décision
C) Forêts aléatoires
D) Méthodes de rééchantillonnage
  • 57. Quelle initiative majeure relie les données provenant de DDBJ, EMBL-EBI et NCBI ?
A) Programme mondial d'échange de données
B) Consortium de données en bio-informatique
C) Collaboration internationale des bases de données de séquences nucléotidiques (INSDC)
D) Initiative mondiale du génome
Créé avec That Quiz — un site de tests de mathématiques pour des étudiants de tous les niveaux d'études.