Statistiken und Big Data

Fragen und Antworten für Personen, die sich für Statistik, maschinelles Lernen, Datenanalyse, Data Mining und Datenvisualisierung interessieren

1
Wie könnte ein Tukey-HSD-Test aussagekräftiger sein als der unkorrigierte P-Wert von t.test?
Ich kam durch den Beitrag " Post-hoc-paarweise Vergleiche von Zwei-Wege-ANOVA " (Antwort auf diesen Beitrag ), der Folgendes zeigt: dataTwoWayComparisons <- read.csv("http://www.dailyi.org/blogFiles/RTutorialSeries/dataset_ANOVA_TwoWayComparisons.csv") model1 <- aov(StressReduction~Treatment+Age, data =dataTwoWayComparisons) summary(model1) # Treatment is signif pairwise.t.test(dataTwoWayComparisons$StressReduction, dataTwoWayComparisons$Treatment, p.adj = "none") # no signif pair TukeyHSD(model1, "Treatment") # mental-medical is the signif pair. (Ausgabe …



3
Wie kann ich die Berechnung der festen Effekte in einem GLMM beschleunigen?
Ich mache eine Simulationsstudie, die Bootstrapping-Schätzungen erfordert, die aus einem verallgemeinerten linearen gemischten Modell erhalten wurden (tatsächlich das Produkt von zwei Schätzungen für feste Effekte, eine von einem GLMM und eine von einem LMM). Um die Studie gut durchzuführen, wären etwa 1000 Simulationen mit jeweils 1000 oder 1500 Bootstrap-Replikationen erforderlich. …
9 r  mixed-model 

1
Welche zeitliche Auflösung für den Zeitreihen-Signifikanztest?
Ich benötige eine Anleitung zum geeigneten Pooling-Level, um Mittelwerttests für Zeitreihendaten durchführen zu können. Ich bin besorgt über die zeitliche und opfernde Pseudo-Replikation, die bei dieser Anwendung unter Spannung zu stehen scheint. Dies bezieht sich eher auf eine Mensurstudie als auf ein manipulatives Experiment. Betrachten Sie eine Überwachungsübung : Ein …



2
R: Grafik dynamisch aktualisieren [geschlossen]
Geschlossen. Diese Frage ist nicht zum Thema . Derzeit werden keine Antworten akzeptiert. Möchten Sie diese Frage verbessern? Aktualisieren Sie die Frage so dass es beim Thema für Kreuz Validated. Geschlossen vor 7 Monaten . Dies ist eine Frage der Datenvisualisierung. Ich habe eine Datenbank, die einige Daten enthält, die …


1
Was sind die praktischen und interpretatorischen Unterschiede zwischen Alternativen und logistischer Regression?
Eine aktuelle Frage zu Alternativen zur logistischen Regression in R ergab eine Vielzahl von Antworten, darunter randomForest-, gbm-, rpart-, bayesglm- und generalisierte additive Modelle. Was sind die praktischen und interpretatorischen Unterschiede zwischen diesen Methoden und der logistischen Regression? Welche Annahmen treffen sie in Bezug auf die logistische Regression (oder nicht)? …



1
Probengröße für Proportionen in wiederholten Messungen
Ich versuche einem Wissenschaftler zu helfen, eine Studie zum Auftreten von Salmonellenmikroben zu entwerfen. Er möchte eine experimentelle antimikrobielle Formulierung mit einem Chlor (Bleichmittel) in Geflügelfarmen vergleichen. Da sich die Hintergrundraten von Salmonellen im Laufe der Zeit unterscheiden, plant er, vor der Behandlung und nach der Behandlung% Geflügel mit Salmonellen …

2
Inkrementelles Lernen für das LOESS-Zeitreihenmodell
Ich arbeite derzeit an einigen Zeitreihendaten. Ich weiß, dass ich das LOESS / ARIMA-Modell verwenden kann. Die Daten werden in einen Vektor mit einer Länge von 1000 geschrieben. Dies ist eine Warteschlange, die alle 15 Minuten aktualisiert wird. Somit werden die alten Daten herausspringen, während die neuen Daten den Vektor …

4
Was sind die Annahmen für die Anwendung eines Tobit-Regressionsmodells?
Mein (sehr grundlegendes) Wissen über das Tobit-Regressionsmodell stammt nicht aus einer Klasse, wie ich es vorziehen würde. Stattdessen habe ich hier und da durch mehrere Internetsuchen Informationen aufgenommen. Ich gehe davon aus, dass die Annahmen für eine verkürzte Regression den gewöhnlichen Annahmen der kleinsten Quadrate (OLS) sehr ähnlich sind. Ich …

Durch die Nutzung unserer Website bestätigen Sie, dass Sie unsere Cookie-Richtlinie und Datenschutzrichtlinie gelesen und verstanden haben.
Licensed under cc by-sa 3.0 with attribution required.