Statistiken und Big Data

Fragen und Antworten für Personen, die sich für Statistik, maschinelles Lernen, Datenanalyse, Data Mining und Datenvisualisierung interessieren


3
Wie kann man den Unterschied zwischen linearen und nichtlinearen Regressionsmodellen erkennen?
Ich habe den folgenden Link zur nichtlinearen Regression SAS Non Linear gelesen . Mein Verständnis beim Lesen des ersten Abschnitts "Nichtlineare Regression vs. Lineare Regression" war, dass die folgende Gleichung tatsächlich eine lineare Regression ist. Ist das richtig? Wenn ja warum? y= b1x3+ b2x2+ b3x + cy=b1x3+b2x2+b3x+cy = b_1x^3 + …

4
Fallstricke bei der Versuchsplanung: Vermeidung toter Versuche
Ich habe dieses Zitat schon oft gesehen: Nach Beendigung eines Experiments den Statistiker zu konsultieren, bedeutet oft nur, ihn zu bitten, eine Obduktion durchzuführen. Er kann vielleicht sagen, woran das Experiment gestorben ist. - Ronald Fisher (1938) Für mich scheint es vielleicht etwas anmaßend. Die einzigen Beispiele, die ich jemals …


17
Wie beschreibt man Statistiken in einem Satz?
Als ich anfing, Statistiken zu lernen, schienen Verfahren wie der T-Test, die ANOVA, das Chi-Quadrat und die lineare Regression jeweils sehr unterschiedliche Wesen zu sein. Aber jetzt merke ich, dass diese Prozeduren mehr oder weniger dasselbe bewirken. Ebenso messen Werte wie Varianz, Residuen, Standardfehler und Mittelwert mehr oder weniger dasselbe. …
27 definition 


3
Was verursacht die Diskontinuität bei der Verteilung der veröffentlichten p-Werte bei p <.05?
In einer kürzlich erschienenen Arbeit haben Masicampo und Lalande (ML) eine große Anzahl von p-Werten gesammelt, die in vielen verschiedenen Studien veröffentlicht wurden. Sie beobachteten einen merkwürdigen Sprung im Histogramm der p-Werte genau auf dem kanonisch kritischen Niveau von 5%. Es gibt eine nette Diskussion über dieses ML-Phänomen auf Prof. …



7
Entspricht die Korrelation der Assoziation?
Mein Statistikprofessor behauptet, dass das Wort "Korrelation" ausschließlich für lineare Beziehungen zwischen Variablen gilt, wohingegen das Wort "Assoziation" allgemein für jede Art von Beziehung gilt. Mit anderen Worten, er behauptet, der Begriff "nichtlineare Korrelation" sei ein Oxymoron. Der Pearson-Korrelationskoeffizient beschreibt, wie ich aus diesem Abschnitt des Wikipedia-Artikels über " Korrelation …


1
Angemessene Restfreiheitsgrade nach dem Löschen von Begriffen aus einem Modell
Ich denke über die Diskussion um diese Frage und insbesondere über Frank Harrells Kommentar nach, dass die Varianzschätzung in einem reduzierten Modell (dh einer, aus der eine Reihe von erklärenden Variablen getestet und verworfen wurden) Yes allgemeine Freiheitsgrade verwenden sollte . Professor Harrell weist darauf hin, dass dies den verbleibenden …

2
Welche praktischen Auswirkungen hat das Schätzen in einem mehrstufigen Modell im Vergleich zum Nichtschätzen von Korrelationsparametern für zufällige Effekte?
Welche praktischen und interpretationsbezogenen Auswirkungen hat das Schätzen in einem mehrstufigen Modell im Vergleich zum Nichtschätzen von Korrelationsparametern für zufällige Effekte? Der praktische Grund, dies zu erfragen, ist, dass es im früheren Framework in R keine implementierte Methode zum Schätzen von p-Werten über MCMC-Techniken gibt, wenn Schätzungen im Modell der …

5
Beispielberichte für eine Mixed-Model-Analyse unter Verwendung von Lmer in Biologie, Psychologie und Medizin?
Da der allgemeine Konsens darin zu bestehen scheint, gemischte Modelle über lmer()in R anstelle der klassischen ANOVA zu verwenden (aus den häufig genannten Gründen, wie unsymmetrische Designs, gekreuzte Zufallseffekte usw.), möchte ich es mit meinen Daten versuchen. Ich befürchte jedoch, dass ich diesen Ansatz meinem Vorgesetzten (der am Ende eine …


Durch die Nutzung unserer Website bestätigen Sie, dass Sie unsere Cookie-Richtlinie und Datenschutzrichtlinie gelesen und verstanden haben.
Licensed under cc by-sa 3.0 with attribution required.