Statistiken und Big Data

Fragen und Antworten für Personen, die sich für Statistik, maschinelles Lernen, Datenanalyse, Data Mining und Datenvisualisierung interessieren





1
Überdispersions- und Modellierungsalternativen in Poisson-Zufallseffektmodellen mit Offsets
Ich bin auf eine Reihe praktischer Fragen gestoßen, wenn ich Zähldaten aus experimenteller Forschung mithilfe eines subjektinternen Experiments modelliere. Ich beschreibe kurz das Experiment, die Daten und das, was ich bisher gemacht habe, gefolgt von meinen Fragen. Einer Stichprobe von Befragten wurden nacheinander vier verschiedene Filme gezeigt. Nach jedem Film …

1
Der standardmäßige lme4-Optimierer erfordert viele Iterationen für hochdimensionale Daten
TL; DR: Die lme4Optimierung scheint standardmäßig in Bezug auf die Anzahl der Modellparameter linear zu sein und ist viel langsamer als ein äquivalentes glmModell mit Dummy-Variablen für Gruppen. Kann ich irgendetwas tun, um es zu beschleunigen? Ich versuche, ein ziemlich großes hierarchisches Logit-Modell (~ 50.000 Zeilen, 100 Spalten, 50 Gruppen) …


3
Wie wählt man ein Konfidenzniveau?
Ich verwende oft ein Konfidenzniveau von 90%, wobei ich akzeptiere, dass dies einen höheren Unsicherheitsgrad als 95% oder 99% aufweist. Aber gibt es Richtlinien zur Auswahl des richtigen Konfidenzniveaus? Oder Richtlinien für die in verschiedenen Bereichen verwendeten Konfidenzniveaus? Gibt es beim Interpretieren und Präsentieren von Vertrauensstufen auch Anleitungen, um die …

1
Was ist der Unterschied zwischen 'Hypothesentest' und 'Modellauswahl'?
In der Literatur werden beide Begriffe oft synonym verwendet oder miteinander verwoben. Ich versuche jetzt, eine klare Unterscheidung zwischen beiden Begriffen zu finden. Aus meiner Sicht wird eine Hypothese normalerweise über ein Modell ausgedrückt. Selbst wenn wir eine Null-gegen-Alternativ-Hypothese testen, machen wir aus meiner Sicht eine Modellauswahl. Kann mir jemand …


2
Abweichung von der Normalitätsannahme in der ANOVA: Ist Kurtosis oder Skewness wichtiger?
Angewandte lineare statistische Modelle von Kutner et al. In Bezug auf Abweichungen von der Normalitätsannahme von ANOVA-Modellen heißt es: Die Kurtosis der Fehlerverteilung (entweder mehr oder weniger als eine Normalverteilung) ist im Hinblick auf die Auswirkungen auf Schlussfolgerungen wichtiger als die Schiefe der Verteilung . Ich bin ein bisschen verwirrt …


1
Wie liest man die Ergebnisse von Dunns Test?
Wie lese ich die Ergebnisse von Dunns Test ? Was sagen mir speziell die Werte in der folgenden Tabelle? Ich habe nicht parametrische Daten in 4 Gruppen und habe zuerst einen Kruskal-Wallis-Test durchgeführt, um zu bestätigen, dass die Verteilungen der Gruppen voneinander und vom aggregierten Datensatz verschieden sind. Dann benutzte …

2
Was sind die Parameter eines Wishart-Wishart posterior?
Wenn die Präzision Matrix infering ΛΛ\boldsymbol{\Lambda} einer Normalverteilung verwendet , zu erzeugen D-dimensionalen Vektoren wir normalerweise einen Wishart vor da die Wishart-Verteilung das Konjugat vor der Präzision einer Multivariate ist Normalverteilung mit bekanntem Mittelwert und unbekannter Varianz: wobei \ upsilon ist die Freiheitsgrade und \ boldsymbol {\ Lambda_0} dieNNNx1,..,xNx1,..,xN\mathbf{x_1},..,\mathbf{x_N} xi∼N(μ,Λ−1)xi∼N(μ,Λ−1)\begin{align} …


Durch die Nutzung unserer Website bestätigen Sie, dass Sie unsere Cookie-Richtlinie und Datenschutzrichtlinie gelesen und verstanden haben.
Licensed under cc by-sa 3.0 with attribution required.