Statistiken und Big Data

Fragen und Antworten für Personen, die sich für Statistik, maschinelles Lernen, Datenanalyse, Data Mining und Datenvisualisierung interessieren

1
Wie interpretiere ich ein "Differenz-in-Differenz" -Modell mit kontinuierlicher Behandlung?
Wie interpretiere ich den ATE-Koeffizienten (dh der Nachbehandlungsindikator interagiert mit der kontinuierlichen Variablen)? Macht das Sinn? Sollte ich es in Untergruppen aufteilen und stattdessen nur ein Modell mit festen Effekten ausführen (einen Indikator für jede Untergruppe mit dem Nachbehandlungsindikator interagieren)?

1
Wald Test und Z Test
Der "z" -Hypothesentest wird aus der Tatsache abgeleitet, dass der mittlere Schätzer normal verteilt ist. Wenn wir die Varianz nicht kennen, schätzen wir sie einfach ( ).Θ^Θ^\hat\Thetas eˆse^\widehat{se} Der Wald-Test basiert auf der Tatsache, dass die Fischerinformationen der MLE im Chi-Quadrat verteilt sind. Grundsätzlich erhalten wir mit beiden Tests das …


1
Wann und wie vermeidet man eine unangemessene Verwendung des exakten Fisher-Tests?
Könnte jemand erklären, warum Richard McElreath sagt, dass der genaue Test von Fisher in seinem ausgezeichneten Bayes'schen Einführungsbuch ( Statistical Rethinking ) selten angemessen verwendet wird ? Als Referenz ist der Kontext unten: Warum reichen die Tests für innovative Forschung nicht aus? Die klassischen Verfahren der Einführungsstatistik sind in der …

1
Welcher adaptive Metropolis Hastings-Algorithmus ist im R-Paket MHadaptive implementiert?
Es gibt mehrere Versionen adaptiver Metropolis Hastings-Algorithmen. Eine ist in der Funktion Metro_Hastingsdes RPakets implementiert MHadaptive, siehe hier . Die dort aufgeführte Referenz, Spiegelhalter et al. (2002) enthält meines Erachtens leider keine Beschreibung eines adaptiven Algorithmus. Der Metro_HastingsAlgorithmus funktioniert jedoch sehr gut bei der Abtastung aus der posterioren Verteilung des …

2
Regression für das Machtrecht
Dies ist ein Crosspost von Math SE . Ich habe einige Daten (Laufzeit eines Algorithmus) und ich denke, dass sie einem Potenzgesetz folgen yr e g= k xeinyreg=kxay_\mathrm{reg} = k x^a Ich möchte und bestimmen . Was ich bisher getan habe, ist eine lineare Regression (kleinste Quadrate) durch und und …


1
Wie kann ich während der Durchführung des Wilcoxon-Rangsummentests eine Variable steuern?
Ich habe einen Wilcoxon-Rangsummentest durchgeführt, um herauszufinden, ob es einen Unterschied in der Verteilung der Variablen für zwei Gruppen gibt. Die Testergebnisse zeigten, dass der Unterschied besteht.X1X1X_1 Ich vermute jedoch, dass es eine verwirrende Variable , die diesen Unterschied verursacht.X2X2X_2 Wie kann ich für steuern ?X2X2X_2 Beispielszenario: Joe möchte verstehen, …

2
Können Sie dieses Chi-Quadrat-Testergebnis reproduzieren?
Bei Skeptics.StackExchange wird in einer Antwort eine Studie zur elektromagnetischen Überempfindlichkeit zitiert: McCarty, Carrubba, Chesson, Frilot, Gonzalez-Toledo und Marino, Elektromagnetische Überempfindlichkeit: Hinweise auf ein neuartiges neurologisches Syndrom International Journal of Neuroscience, 00, 1–7, 2011, DOI: 10.3109 / 00207454.2011.608139. Ich bin zweifelhaft in Bezug auf einige der verwendeten Statistiken und würde …



2
Fehlendes Quartil im Boxplot
Derzeit erstelle ich ein Boxplot. Ich bin neu auf dem Gebiet der Statistik und insbesondere der Boxplots. Finden Sie das Bild wie folgt: Auf der y-Achse finden Sie die Anzahl der Nachrichten. Ich habe Probleme zu verstehen, was ich dort sehe. Der Plot wird von Matlab automatisch erstellt. Wie ich …

3
Ist es möglich, eine Regression durchzuführen, bei der Sie eine unbekannte / nicht erkennbare Feature-Variable haben?
Ist es möglich, eine Regression durchzuführen, bei der Sie eine unbekannte / nicht erkennbare Feature-Variable haben? Sag ich habe yn=a0+a1x1+a2x2+a3x3yn=a0+a1x1+a2x2+a3x3y_n = a_0 + a_1 x_1 + a_2 x_2 + a_3 x_3 aber ich kann / kann den Wert der Merkmalsvariablen nicht messen x3x3x_3. Kann ich trotzdem eine Regression durchführen, um …

1
Warum ist die Leistung eines Hypothesentests ein Problem, wenn wir eine repräsentative Stichprobe booten können, um n gegen unendlich zu bringen?
Warum interessiert uns die Leistungsfähigkeit eines Hypothesentests, wenn wir nicht mehr in einem Zeitalter leben, in dem Computer langsam sind und es zu kostspielig ist, einen Permutationstest für alles durchzuführen, was auch nicht parametrisch ist? Ist die Leistungsanalyse irrelevant, wenn ich einen Bootstrap- / Permutationshypothesentest durchführen kann? Wir können die …


Durch die Nutzung unserer Website bestätigen Sie, dass Sie unsere Cookie-Richtlinie und Datenschutzrichtlinie gelesen und verstanden haben.
Licensed under cc by-sa 3.0 with attribution required.