Statistiken und Big Data

Fragen und Antworten für Personen, die sich für Statistik, maschinelles Lernen, Datenanalyse, Data Mining und Datenvisualisierung interessieren

2
Daten simulieren, um sie an ein Mediationsmodell anzupassen
Ich bin daran interessiert, ein Verfahren zur Simulation von Daten zu finden, die mit einem bestimmten Mediationsmodell übereinstimmen. Gemäß dem allgemeinen Framework für lineare Strukturgleichungsmodelle zum Testen von Mediationsmodellen, das zuerst von Barron und Kenny (1986) skizziert und an anderer Stelle wie Judd, Yzerbyt & Muller (2013) beschrieben wurde , …



3
Warum funktioniert der Satz von Bayes grafisch?
Aus mathematischer Sicht ist der Satz von Bayes für mich vollkommen sinnvoll (dh ableiten und beweisen), aber ich weiß nicht, ob es ein schönes geometrisches oder grafisches Argument gibt, das gezeigt werden kann, um den Satz von Bayes zu erklären. Ich habe versucht, nach einer Antwort zu suchen, und überraschenderweise …



1
Verwenden der Hauptkomponentenanalyse im Vergleich zur Korrespondenzanalyse
Ich analysiere einen Datensatz über Gezeitengemeinschaften. Die Daten beziehen sich auf die prozentuale Abdeckung (von Seetang, Seepocken, Muscheln usw.) in Quadraten. Ich bin zu Denken über Korrespondenzanalyse (CA) in Bezug auf die Arten verwendet zählt, und Hauptkomponentenanalyse (PCA) als etwas nützlicher für lineare Umwelt (nicht Spezies) Trends. Ich hatte nicht …


3
Bücher zur statistischen Ökologie?
Ich weiß, dass diese Frage schon einmal gestellt wurde: Nachschlagewerk für ökologische Studien, aber es ist nicht das, wonach ich suche. Was ich suche ist, ob jemand ein gutes Buch (oder eine kanonische Referenz) über statistische Ökologie empfehlen könnte? Ich habe ein sehr gutes Verständnis für Statistik, so dass das …

2
Berechnungsintervall berechnen
Ich habe die folgenden Daten hier . Ich versuche, das 95% -Konfidenzintervall für die mittlere Reinheit zu berechnen, wenn der Kohlenwasserstoffprozentsatz 1,0 beträgt. In R gebe ich Folgendes ein. > predict(purity.lm, newdata=list(hydro=1.0), interval="confidence", level=.95) fit lwr upr 1 89.66431 87.51017 91.81845 Wie kann ich dieses Ergebnis jedoch selbst ableiten? Ich …

4
Verwenden der logistischen Regression für eine kontinuierliche abhängige Variable
Ich habe kürzlich eine Überarbeitung für mein Forschungspapier erhalten. Das Folgende ist der Kommentar des Rezensenten zu meinem Papier: Die Ergebnisse eines Modells sind nicht ganz überzeugend, insbesondere die lineare Regression weist normalerweise Mängel im Umgang mit Ausreißern auf. Ich schlage vor, dass die Autoren auch eine logistische Regression versuchen …



1
Gibt es eine konventionelle Bedeutung des Symbols in der Statistik?
Ich las eine Arbeit über die Bayes'sche Kurvenanpassung ( Dimatteo et al. Bayesianische Kurvenanpassung mit Freiknoten-Splines, 2001 ) und stieß auf das Symbol ≏≏\bumpeq . Es wird im gesamten Artikel einige Male verwendet, jedoch nie explizit definiert. Nach einigen Google- und Stackexchange-Suchen scheint das Symbol weder weit verbreitet noch konventionell …

1
Interpretation der Geigenhandlungen
Ich vergleiche die Verteilung verschiedener Gruppen anhand der Geigen-Diagramme. Die meisten Online-Ressourcen, die ich gefunden habe, beziehen sich jedoch nur auf die Erstellung der Diagramme und die sehr grundlegende Interpretation der Ergebnisse (die mittlere Variation, die Daten sind gruppiert oder nicht). Ich suche nach detaillierten Beispielen, denen ich als Richtlinie …

Durch die Nutzung unserer Website bestätigen Sie, dass Sie unsere Cookie-Richtlinie und Datenschutzrichtlinie gelesen und verstanden haben.
Licensed under cc by-sa 3.0 with attribution required.