Statistiken und Big Data

Fragen und Antworten für Personen, die sich für Statistik, maschinelles Lernen, Datenanalyse, Data Mining und Datenvisualisierung interessieren


3
Wie berechne ich ein Konfidenzintervall für den Mittelwert eines Protokollnormaldatensatzes?
Ich habe an mehreren Stellen gehört / gesehen, dass Sie den Datensatz in etwas normalverteiltes transformieren können, indem Sie den Logarithmus jeder Stichprobe nehmen, das Konfidenzintervall für die transformierten Daten berechnen und das Konfidenzintervall mit der inversen Operation zurücktransformieren (Erhöhen Sie z. B. 10 um die Potenz der unteren bzw. …

4
Wie fange ich mit der Bewertung und dem Ranking an, die auf paarweisen Wettbewerbsdaten basieren?
Ich interessiere mich für das Bewerten und Einordnen von Personen in einer Gruppe, die nur paarweise interagieren / gegeneinander antreten (dh Systeme wie das ELO- Bewertungssystem für Schach). Gibt es Go-to-Methoden oder genauere und fortgeschrittenere Methoden? Gibt es R-Pakete, die die Implementierung vereinfachen? Gibt es Methoden, die Zusatzinformationen sowie das …



3
Welche Bedeutung hat die Funktion
In meiner Kalkülklasse sind wir auf die Funktion oder die "Glockenkurve" gestoßen , und mir wurde gesagt, dass sie in der Statistik häufig angewendet wird.e- x2e-x2e^{-x^2} Aus Neugier möchte ich fragen: Ist die Funktion in der Statistik wirklich wichtig? Wenn ja, warum ist so nützlich, und wie sehen einige seiner …



1
Predictive Modeling - Sollten wir uns für gemischte Modelle interessieren?
Müssen wir uns für die prädiktive Modellierung mit statistischen Konzepten wie zufälligen Effekten und der Nichtunabhängigkeit von Beobachtungen (wiederholte Messungen) befassen? Beispielsweise.... Ich habe Daten aus 5 Direktmailing-Kampagnen (die im Laufe eines Jahres durchgeführt wurden) mit verschiedenen Attributen und einer Kaufmarkierung. Idealerweise würde ich all diese Daten zusammen verwenden, um …

8
Clustering gemischter Datentypen mit R
Verschlossen . Diese Frage und ihre Antworten sind gesperrt, da die Frage nicht zum Thema gehört, aber von historischer Bedeutung ist. Derzeit werden keine neuen Antworten oder Interaktionen akzeptiert. Ich frage mich, ob es möglich ist, innerhalb von R ein Clustering von Daten mit gemischten Datenvariablen durchzuführen. Mit anderen Worten, …

1
Verwendung des Standardfehlers der Bootstrap-Verteilung
(ignoriere den R-Code falls nötig, da meine Hauptfrage sprachunabhängig ist) Wenn ich die Variabilität einer einfachen Statistik (zB Mittelwert) untersuchen möchte, weiß ich, dass ich das mit folgender Theorie tun kann: x = rnorm(50) # Estimate standard error from theory summary(lm(x~1)) # same as... sd(x) / sqrt(length(x)) oder mit dem …

3
ARIMA-Modellinterpretation
Diese Frage wurde von Mathematics Stack Exchange migriert, da sie auf Cross Validated beantwortet werden kann. Vor 7 Jahren migriert . Ich habe eine Frage zu ARIMA-Modellen. Angenommen, ich habe eine Zeitreihe YtYtY_t , die ich prognostizieren möchte, und ein ARIMA(2,2)ARIMA(2,2)\text{ARIMA}(2,2) -Modell scheint eine gute Möglichkeit zu sein, die Prognoseübung …



1
Multiple Mediationsanalyse in R
Ich frage mich, ob jemand eine Möglichkeit kennt, ein Multi-Mediationsmodell in R auszuführen. Ich weiß, dass das Mediationspaket mehrere einfache Mediationsmodelle zulässt, aber ich möchte ein Modell ausführen, das mehrere Mediationsmodelle gleichzeitig auswertet. Ich gehe davon aus, dass ich dies in einem SEM-Framework (Pfadanalyse) tun kann, habe mich aber gefragt, …

Durch die Nutzung unserer Website bestätigen Sie, dass Sie unsere Cookie-Richtlinie und Datenschutzrichtlinie gelesen und verstanden haben.
Licensed under cc by-sa 3.0 with attribution required.