Statistiken und Big Data

Fragen und Antworten für Personen, die sich für Statistik, maschinelles Lernen, Datenanalyse, Data Mining und Datenvisualisierung interessieren

1
Fisher's Exact Test und hypergeometrische Verteilung
Ich wollte den genauen Test des Fischers besser verstehen, deshalb habe ich das folgende Spielzeugbeispiel entwickelt, bei dem f und m männlich und weiblich und n und y dem "Sodakonsum" wie folgt entsprechen: > soda_gender f m n 0 5 y 5 0 Dies ist natürlich eine drastische Vereinfachung, aber …


2
Was bedeutet es, wenn alle Kanten in einem realen Netzwerk / Diagramm statistisch genauso zufällig sind?
Ich habe die in diesem Dokument beschriebene Methode zur Extraktion des Backbone-Netzwerks verwendet: http://www.pnas.org/content/106/16/6483.abstract Grundsätzlich schlagen die Autoren eine statistische Methode vor, die für jede Kante im Diagramm eine Wahrscheinlichkeit erzeugt, dass die Kante zufällig entstanden sein könnte. Ich verwende den typischen statistischen Signifikanzgrenzwert von 0,05. Ich habe diese Methode …


4
Wie man einen Koeffizienten festlegt und andere mithilfe der Regression anpasst
Ich möchte einen bestimmten Koeffizienten manuell festlegen, z. B. , und dann die Koeffizienten an alle anderen Prädiktoren anpassen, während im Modell erhalten .β1=1.0β1=1.0\beta_1=1.0β1=1.0β1=1.0\beta_1=1.0 Wie kann ich dies mit R erreichen? Ich würde besonders gerne mit LASSO ( glmnet) arbeiten, wenn möglich. Wie kann ich diesen Koeffizienten alternativ auf einen …




2
Warum ist die Verwendung von Querschnittsdaten zum Ableiten / Vorhersagen von Längsveränderungen eine schlechte Sache?
Ich suche ein Papier, von dem ich hoffe, dass es existiert, weiß aber nicht, ob es existiert. Es könnte sich um eine Reihe von Fallstudien und / oder ein Argument aus der Wahrscheinlichkeitstheorie handeln, warum die Verwendung von Querschnittsdaten zum Ableiten / Vorhersagen von Längsschnittänderungen eine schlechte Sache sein kann …


4
Logistische Regression und Wendepunkt
Wir haben Daten mit einem binären Ergebnis und einigen Kovariaten. Ich habe die Daten mithilfe der logistischen Regression modelliert. Nur eine einfache Analyse, nichts Außergewöhnliches. Die endgültige Ausgabe soll eine Dosis-Wirkungs-Kurve sein, in der wir zeigen, wie sich die Wahrscheinlichkeit für eine bestimmte Kovariate ändert. Etwas wie das: Wir erhielten …


1
Warum basiert die Diagnose auf Residuen?
Bei einer einfachen linearen Regression möchte man oft überprüfen, ob bestimmte Annahmen erfüllt sind, um Rückschlüsse ziehen zu können (z. B. sind Residuen normalverteilt). Ist es sinnvoll, die Annahmen zu überprüfen, indem überprüft wird, ob die angepassten Werte normal verteilt sind?


1
Für welche Verteilungen bedeutet Unkorrelation Unabhängigkeit?
Eine altehrwürdige Erinnerung in der Statistik ist "Unkorreliertheit bedeutet nicht Unabhängigkeit". Normalerweise wird diese Erinnerung durch die psychologisch beruhigende (und wissenschaftlich korrekte) Aussage ergänzt, "wenn die beiden Variablen dennoch gemeinsam normal verteilt sind , bedeutet Unkorrelation Unabhängigkeit". Ich kann die Anzahl der glücklichen Ausnahmen von eins auf zwei erhöhen: Wenn …

Durch die Nutzung unserer Website bestätigen Sie, dass Sie unsere Cookie-Richtlinie und Datenschutzrichtlinie gelesen und verstanden haben.
Licensed under cc by-sa 3.0 with attribution required.