- 1. Die Biostatistik ist ein Teilgebiet der Statistik, das sich mit Daten über lebende Organismen befasst. Sie befasst sich mit dem Entwurf, der Analyse und der Interpretation von Daten in Bereichen wie Biologie, Medizin, öffentliche Gesundheit und Umweltwissenschaften. Die Biostatistik spielt eine entscheidende Rolle bei Forschungsstudien, klinischen Versuchen und Initiativen im Bereich der öffentlichen Gesundheit, indem sie statistische Methoden zur Analyse von Daten, zum Ziehen von Schlussfolgerungen und zum Treffen fundierter Entscheidungen bereitstellt. Sie hilft dabei, Krankheitsmuster zu verstehen, Risikofaktoren zu ermitteln, Behandlungsmaßnahmen zu bewerten und gesundheitliche Ergebnisse vorherzusagen. Biostatistiker nutzen ihr Fachwissen über statistische Theorien und Methoden, um komplexe Forschungsfragen zu beantworten und zu Fortschritten in der Gesundheitswissenschaft und -politik beizutragen.
Was ist der Zweck von Hypothesentests in der Biostatistik?
A) Um festzustellen, ob es genügend Beweise gibt, um eine Nullhypothese zu verwerfen. B) Zur Berechnung der Standardabweichung. C) Eine Hypothese mit 100%iger Sicherheit zu beweisen. D) Schätzung des Mittelwerts der Grundgesamtheit.
- 2. Welche Rolle spielt die Kontrollgruppe in einer klinischen Studie?
A) Bereitstellung einer Basislinie für den Vergleich mit der Behandlungsgruppe. B) Analyse der Ergebnisse. C) Daten von den Teilnehmern zu sammeln. D) Verabreichung der Behandlung an die Teilnehmer.
- 3. Welche Art von Studiendesign ist am besten geeignet, um Ursache-Wirkungs-Beziehungen zu ermitteln?
A) Randomisierte, kontrollierte Studie B) Fall-Kontroll-Studie C) Querschnittliche Studie D) Beobachtungsstudie
- 4. Was bedeutet Sensitivität im Zusammenhang mit diagnostischen Tests?
A) Der Anteil der falsch negativen Ergebnisse. B) Der Anteil wahrer positiver Ergebnisse unter allen Personen mit der Krankheit. C) Der Anteil der falsch positiven Ergebnisse. D) Der Anteil wahrer negativer Ergebnisse unter allen Personen ohne die Erkrankung.
- 5. Bei welcher Art von Stichprobenverfahren wird eine Grundgesamtheit in Untergruppen unterteilt und dann eine Stichprobe aus jeder Untergruppe gezogen?
A) Cluster-Stichproben B) Stratifizierte Stichproben C) Systematische Probenahme D) Einfache Zufallsstichprobe
- 6. Welcher statistische Test kann verwendet werden, um mehr als zwei Gruppenmittelwerte zu vergleichen?
A) Gepaarter t-Test B) Chi-Quadrat-Test C) ANOVA D) Zwei-Stichproben-t-Test
- 7. Was besagt der p-Wert bei Hypothesentests?
A) Der für die Studie erforderliche Stichprobenumfang. B) Die Wahrscheinlichkeit, unter der Annahme, dass die Nullhypothese wahr ist, Ergebnisse zu erhalten, die genauso extrem sind wie die beobachteten Ergebnisse. C) Die Stärke der Beziehung zwischen den Variablen. D) Das Konfidenzintervall der Schätzung.
- 8. Was ist der Zweck der Regressionsanalyse?
A) Untersuchung der Beziehung zwischen einer abhängigen Variable und einer oder mehreren unabhängigen Variablen. B) Zur Ermittlung der zentralen Tendenz. C) Schätzung von Populationsparametern. D) Zur Berechnung der Wahrscheinlichkeiten.
- 9. Wie wird Biostatistik auch bezeichnet?
A) Biometrie B) Bioinformatik C) Biomathematik D) Biomechanik
- 10. Welches Fachgebiet steht in engem Zusammenhang mit der medizinischen Statistik?
A) Biostatistik B) Epidemiologie C) Pharmakologie D) Pathologie
- 11. Wer hat die Genetik begründet, indem er die Vererbungsmuster in Erbsenpflanzen untersuchte?
A) Charles Darwin B) Gregor Mendel C) William Bateson D) Francis Galton
- 12. Wer widersprach Francis Galtons Theorien zur Vererbung entschieden?
A) Raphael Weldon B) William Bateson C) Arthur Dukinfield Darbishire D) Karl Pearson
- 13. Welche Gruppe unterstützte Mendels Ideen zur Vererbung?
A) Darwinisten B) Biometristen C) Mendelisten D) Neo-Darwinisten
- 14. Wer hat die Konzepte der ANOVA (Varianzanalyse) und des p-Wertes entwickelt?
A) J. B. S. Haldane B) Ronald Fisher C) Betty Allan D) Sewall G. Wright
- 15. Wer hat die F-Statistiken und die Methoden zur Berechnung entwickelt?
A) Betty Allan B) Sewall G. Wright C) J. B. S. Haldane D) Ronald Fisher
- 16. Welchen Mechanismus der Evolution hat das Buch von J. B. S. Haldane wieder als den wichtigsten etabliert?
A) Natürliche Selektion B) Genaustausch C) Mutation D) Genetische Drift
- 17. Wer hat den Taschenrechner "Friden" aus seiner Abteilung am Caltech verboten?
A) Sewall G. Wright B) Ronald Fisher C) Thomas Hunt Morgan D) J. B. S. Haldane
- 18. Welche der folgenden Optionen ist KEIN grundlegendes Prinzip der experimentellen Statistik?
A) Lokale Kontrolle B) Bestimmung der Stichprobengröße C) Zufallsverteilung D) Wiederholung
- 19. Was sollte bei der Formulierung einer Forschungsfrage berücksichtigt werden?
A) Eine umfassende Literaturrecherche. B) Aspekte der Datenanalyse. C) Kostenüberlegungen. D) Das Studiendesign.
- 20. Welcher Aspekt der Forschungsplanung beinhaltet die Definition, wie eine wissenschaftliche Frage gestellt werden soll?
A) Die damit verbundenen Kosten. B) Perspektiven der Datenanalyse. C) Die Forschungsfrage. D) Experimentelles Design.
- 21. Welches Prinzip der experimentellen Statistik hilft, Verzerrungen zu vermeiden?
A) Lokale Kontrolle B) Kostenabschätzung C) Zufallsallokation D) Replikation
- 22. Welcher ist laut dem Text der erste Schritt bei der Formulierung einer Forschungsfrage?
A) Das Design des Experiments entwerfen. B) Eine umfassende Literaturrecherche durchführen. C) Die Kosten schätzen. D) Die Methoden zur Datenerhebung festlegen.
- 23. Welcher Cloud-Dienstleister wird als Werkzeug für die statistische Analyse von biologischen Daten genannt?
A) IBM Cloud B) Amazon Web Services C) Google Cloud Platform D) Microsoft Azure
- 24. Welche Datenbank speichert Assemblierungen und Annotationsdateien von Dutzenden von Pflanzengenomen?
A) TAIR B) KEGG C) Phytozome D) dbSNP
- 25. Worauf basiert eine genomweite Assoziationsstudie (GWAS)?
A) Vererbungsungleichgewicht. B) Genomische Selektion. C) Quantitative Merkmalsorte. D) Rekombinationshäufigkeit.
- 26. Welche Methode berücksichtigt die Veränderung ganzer Gen-Gruppen anstatt einzelner Gene?
A) Hauptkomponentenanalyse B) Analyse der Gen-Enrichment (Gene Set Enrichment Analysis, GSEA) C) Lineare Diskriminanzanalyse D) Sequenzierung der nächsten Generation
- 27. Welches Werkzeug wird für die Datenverarbeitung auf hoher Ebene, Data Mining und Visualisierung verwendet?
A) Orange B) CycDesigN C) ASReml D) PLA 3.0
- 28. Wer hat Histogramme als grafische Darstellung eingeführt?
A) John Tukey B) Ronald Fisher C) Karl Pearson D) Francis Galton
- 29. Welche Datenbank wird für die Indexierung wissenschaftlicher Artikel verwendet?
A) dbSNP B) PubMed C) KEGG D) Gene Ontology
- 30. Welche wichtige Initiative verknüpft Daten von DDBJ, EMBL-EBI und NCBI?
A) Globale Genom-Initiative B) Weltweites Datenaustauschprogramm C) Internationale Zusammenarbeit von Nukleotidsequenzdatenbanken (INSDC) D) Bioinformatik-Datenkonsortium
- 31. Welche Datenbank konzentriert sich auf SNPs?
A) PubMed B) dbSNP C) KEGG D) Gene Ontology
- 32. Welche Datenbank ist speziell für Arabidopsis thaliana vorgesehen?
A) TAIR B) KEGG C) Phytozome D) dbSNP
- 33. Welche Software ist ein Java-basiertes Werkzeug für maschinelles Lernen und Datenanalyse?
A) SAS B) Weka C) R D) Orange
- 34. Welche Verteilung wurde anfänglich für die Zähldaten der RNA-Sequenzierung verwendet, unterschätzte aber den Messfehler?
A) Binomialverteilung B) Negative Binomialverteilung C) Normalverteilung D) Poisson-Verteilung
- 35. Welche biostatistische Methode hat für die statistische Klassifizierung an Popularität gewonnen?
A) Entscheidungsbäume B) Bootstrapping C) Zufallssträucher (Random Forests) D) Resampling-Methoden
- 36. In der Formel für den arithmetischen Mittelwert, was repräsentiert das Symbol '∑'?
A) Produkt B) Summe C) Differenz D) Division
- 37. Wie wird ein Streudiagramm auch genannt?
A) Streudiagramm B) Balkendiagramm C) Histogramm D) Kreisdiagramm
- 38. Welche biostatistische Methode hilft bei der Reduzierung der Variablendimension durch die Transformation von Prädiktoren in eine kleinere Menge unkorrelierter Komponenten?
A) Lineare Regression B) Analyse der Gen-Enrichment C) Logistische Regression D) Hauptkomponentenanalyse
- 39. Welche Art von Diagramm eignet sich am besten, um Veränderungen im Zeitverlauf darzustellen?
A) Kreisdiagramm B) Liniendiagramm C) Histogramm D) Balkendiagramm
- 40. Welche Achse stellt in einem Liniendiagramm typischerweise die Zeit dar?
A) Die vertikale Achse B) Beide Achsen stellen die Zeit gleichermaßen dar C) Die horizontale Achse D) Die Zeit wird in einem Liniendiagramm nicht dargestellt
- 41. Wie nennt man ein Streudiagramm noch?
A) Kreisdiagramm B) Liniendiagramm C) Streudiagramm D) Balkendiagramm
- 42. Welche Software unterstützt quantitative Analyseverfahren für regulierte Bereiche wie beispielsweise Arzneimitteltests?
A) SAS B) PLA 3.0 C) Apache Spark D) Weka
- 43. Wie nennt man die hohe Korrelation zwischen Prädiktoren in biostatistischen Kontexten?
A) Multikollinearität B) Anreicherung von Genmengen C) Dimensionsreduktion D) Hauptkomponentenanalyse
- 44. Welche Programmiersprache wird im Bereich des Deep Learning und der Bildanalyse in der Bioinformatik eingesetzt?
A) SAS B) SQL C) Python D) R
- 45. Welches Symbol repräsentiert den arithmetischen Mittelwert in mathematischer Notation?
A) n B) i C) x̄ D) Σ
- 46. Welchen Nutzen hat eine klar formulierte Forschungsfrage für die wissenschaftliche Gemeinschaft?
A) Sie minimiert die Kosten. B) Sie vereinfacht die Datenanalyse. C) Sie schafft Mehrwert durch neue Erkenntnisse. D) Sie reduziert den Bedarf an Wiederholungen von Studien.
- 47. Welcher Algorithmus wird nicht üblicherweise in der QTL-Analyse (Quantitative Trait Loci-Analyse) verwendet?
A) Intervall-Mapping B) Mehrfach-Intervall-Mapping C) Kompositives Intervall-Mapping D) Keine der oben genannten
- 48. Welcher Aspekt der Forschungsplanung beinhaltet die Festlegung, wie Daten gesammelt werden sollen?
A) Hypothesenprüfung. B) Methoden zur Datenerhebung. C) Formulierung der Forschungsfrage. D) Kostenabschätzung.
- 49. Was ist das Ziel der markergestützten Selektion?
A) Ergebnisse der Züchtung in der Landwirtschaft. B) Modelle für die genomische Selektion. C) Systeme zur Unterstützung klinischer Entscheidungen. D) Quantitativer Merkmalsabbau.
- 50. Was repräsentiert ein Signifikanzniveau (α) bei Hypothesentests?
A) Der Korrelationskoeffizient zwischen zwei Variablen. B) Die Wahrscheinlichkeit, dass die Nullhypothese wahr ist. C) Der Wertebereich für ein Konfidenzintervall. D) Die akzeptable Fehlerrate bei der Entscheidung über statistische Signifikanz.
- 51. Was bedeutet ein Pearson-Korrelationskoeffizient von -1?
A) Eine nicht definierte Beziehung B) Eine perfekte negative Korrelation C) Keine lineare Korrelation D) Eine perfekte positive Korrelation
- 52. Wie lautet die Formel zur Berechnung der Gesamtzahl der Beobachtungen (N) in einer Häufigkeitstabelle?
A) N = fi - N B) N = fi / N C) N = fi * N D) N = f1 + f2 + f3 + ... + fn
- 53. Welche Programmiersprache ist bekannt für ihre Open-Source-Umgebung und ihre Fähigkeiten im Bereich der statistischen Datenverarbeitung, wobei Pakete über CRAN verfügbar sind?
A) R B) Python C) SQL D) MATLAB
- 54. Welche Software wird für lineare Algebra-Berechnungen verwendet?
A) LAPACK B) NumPy C) SageMath D) SciPy
- 55. Welche statistischen Modelle werden verwendet, um Tests auf statistische Signifikanz bei der Analyse von RNA-Sequenzierungsdaten durchzuführen?
A) Generalisierte lineare Modelle B) Lineare Regressionsmodelle C) Chi-Quadrat-Tests D) ANOVA (Varianzanalyse)
- 56. Welches Softwarepaket ermöglicht die Schätzung von Varianzkomponenten innerhalb eines allgemeinen linearen gemischten Modells unter Verwendung der REML-Methode?
A) ASReml B) SAS C) CycDesigN D) Orange
- 57. In welchem Bereich ist die Gestaltung und Analyse klinischer Studien besonders wichtig?
A) Quantitative Genetik B) Tierzucht C) Systemmedizin D) Öffentliche Gesundheit
|