Statistiken und Big Data

Fragen und Antworten für Personen, die sich für Statistik, maschinelles Lernen, Datenanalyse, Data Mining und Datenvisualisierung interessieren

8
Wie können Sie die Beziehung zwischen 3 kategorialen Variablen visualisieren?
Ich habe einen Datensatz mit drei kategorialen Variablen und möchte die Beziehung zwischen allen drei Variablen in einem Diagramm visualisieren. Irgendwelche Ideen? Derzeit verwende ich die folgenden drei Grafiken: Jedes Diagramm ist für eine Grundlinien-Depression (Mild, Moderat, Schwerwiegend). Dann betrachte ich in jedem Diagramm die Beziehung zwischen Behandlung (0,1) und …





2
Welche Beziehung besteht zwischen dem GINI-Score und dem Log-Likelihood-Verhältnis?
Ich studiere Klassifikations- und Regressionsbäume, und eine der Kennzahlen für den geteilten Standort ist der GINI-Score. Jetzt bin ich es gewohnt, den besten Split-Standort zu bestimmen, wenn das Protokoll des Wahrscheinlichkeitsverhältnisses der gleichen Daten zwischen zwei Verteilungen Null ist, was bedeutet, dass die Wahrscheinlichkeit einer Mitgliedschaft gleich wahrscheinlich ist. Meine …

2
Wie wende ich binomiales GLMM (glmer) auf Prozentsätze anstelle von Ja-Nein-Zählungen an?
Ich habe ein Experiment mit wiederholten Messungen, bei dem die abhängige Variable ein Prozentsatz ist, und ich habe mehrere Faktoren als unabhängige Variablen. Ich würde gerne glmerdas R-Paket verwenden lme4, um es als logistisches Regressionsproblem zu behandeln (indem ich es spezifiziere family=binomial), da es dieses Setup direkt zu berücksichtigen scheint. …



6
Posterior sehr unterschiedlich zu Prior und Likelihood
Wenn der Prior und die Wahrscheinlichkeit sehr unterschiedlich sind, tritt manchmal eine Situation auf, in der der Posterior keinem von beiden ähnlich ist. Siehe zum Beispiel dieses Bild, das Normalverteilungen verwendet. Obwohl dies mathematisch korrekt ist, scheint es nicht mit meiner Intuition übereinzustimmen - wenn die Daten nicht mit meinen …





2
Kombination von Informationen aus mehreren Studien zur Abschätzung des Mittelwerts und der Varianz normalverteilter Daten - Bayesianischer vs. metaanalytischer Ansatz
Ich habe eine Reihe von Papieren durchgesehen, die jeweils den beobachteten Mittelwert und die SD einer Messung von in ihrer jeweiligen Stichprobe bekannter Größe, n , angeben . Ich möchte in einer neuen Studie, die ich entwerfe, die bestmögliche Vermutung über die wahrscheinliche Verteilung derselben Kennzahl anstellen und wie viel …

Durch die Nutzung unserer Website bestätigen Sie, dass Sie unsere Cookie-Richtlinie und Datenschutzrichtlinie gelesen und verstanden haben.
Licensed under cc by-sa 3.0 with attribution required.