Statistiken und Big Data

Fragen und Antworten für Personen, die sich für Statistik, maschinelles Lernen, Datenanalyse, Data Mining und Datenvisualisierung interessieren

2
Konfidenzintervall für Chi-Quadrat
Ich versuche eine Lösung zu finden, um zwei "Anpassungsgüte-Chi-Quadrat" -Tests zu vergleichen. Genauer gesagt möchte ich die Ergebnisse zweier unabhängiger Experimente vergleichen. In diesen Experimenten verwendeten die Autoren das Chi-Quadrat der Anpassungsgüte, um zufällige Schätzungen (erwartete Frequenzen) mit beobachteten Frequenzen zu vergleichen. Die beiden Experimente hatten die gleiche Teilnehmerzahl und …

3
Strukturgleichungsmodellierung mit wiederholten Messungen
Ich muss einen Datensatz mit Daten zur klinischen Rehabilitation analysieren. Ich interessiere mich für hypothesengetriebene Beziehungen zwischen quantifiziertem "Input" (Therapiemenge) und Veränderungen des Gesundheitszustands. Obwohl der Datensatz relativ klein ist (n ~ 70), haben wir wiederholte Daten, die zeitliche Änderungen in beiden widerspiegeln. Ich bin mit der nichtlinearen Modellierung gemischter …

4
Gibt es eine Möglichkeit, die Kreuzvalidierung zu verwenden, um eine Variablen- / Merkmalsauswahl in R durchzuführen?
Ich habe einen Datensatz mit ungefähr 70 Variablen, die ich reduzieren möchte. Ich möchte den Lebenslauf verwenden, um die nützlichsten Variablen auf folgende Weise zu finden. 1) Wählen Sie zufällig etwa 20 Variablen aus. 2) Verwenden Sie stepwise/ LASSO/ lars/ etc, um die wichtigsten Variablen auszuwählen. 3) Wiederholen Sie ~ …

4
Erklärung der statistischen Simulation
Ich bin kein Statistiker. Also, bitte ertragen Sie meine Fehler, wenn überhaupt. Würden Sie bitte auf einfache Weise erklären, wie die Simulation durchgeführt wird? Ich weiß, dass es eine zufällige Stichprobe aus einer Normalverteilung auswählt und zur Simulation verwendet. Aber verstehe nicht klar.
10 simulation 

3
Erster kurzer Blick auf einen Datensatz
Bitte verzeihen Sie meine Unwissenheit, aber ... Ich befinde mich immer wieder in einer Situation, in der ich mit einer Reihe neuer Daten konfrontiert bin, die ich gefunden habe. Diese Daten sehen normalerweise ungefähr so ​​aus: Date Number1 Number2 Category1 Category2 20120125 11 101 Dog Brown 20120126 21 90 Cat …




1
Baumgröße in Gradientenbaumverstärkung
Die von Friedman vorgeschlagene Erhöhung des Gradientenbaums verwendet Entscheidungsbäume mit JEndknoten (= Blätter) als Basislerner. Es gibt eine Reihe von Möglichkeiten, einen Baum mit genau JKnoten zu züchten, zum Beispiel kann man den Baum in der Tiefe zuerst oder in der Breite zuerst züchten, ... Gibt es eine etablierte Methode, …
10 r  cart  boosting 

4
Wie interpretiere ich logarithmisch transformierte Koeffizienten in der linearen Regression?
Meine Situation ist: Ich habe 1 kontinuierliche abhängige und 1 kontinuierliche Prädiktorvariable, die ich logarithmisch transformiert habe, um ihre Residuen für eine einfache lineare Regression zu normalisieren. Ich würde mich über jede Hilfe freuen, wie ich diese transformierten Variablen mit ihrem ursprünglichen Kontext in Beziehung setzen kann. Ich möchte eine …


1
Was ist die Nullhypothese im Mann-Whitney-Test?
Sei ein Zufallswert aus Verteilung 1 und sei ein Zufallswert aus Verteilung 2. Ich dachte, dass die Nullhypothese für den Mann-Whitney-Test .X1X1X_1X2X2X_2P(X1&lt;X2)=P(X2&lt;X1)P(X1&lt;X2)=P(X2&lt;X1)P(X_1 < X_2) = P(X_2 < X_1) Wenn ich Simulationen des Mann-Whitney-Tests mit Daten aus Normalverteilungen mit gleichen Mitteln und gleichen Varianzen mit , erhalte ich Fehlerraten vom Typ …




Durch die Nutzung unserer Website bestätigen Sie, dass Sie unsere Cookie-Richtlinie und Datenschutzrichtlinie gelesen und verstanden haben.
Licensed under cc by-sa 3.0 with attribution required.