Statistiken und Big Data

Fragen und Antworten für Personen, die sich für Statistik, maschinelles Lernen, Datenanalyse, Data Mining und Datenvisualisierung interessieren




8
Wenn der p-Wert genau 1 (1.0000000) ist, wie hoch sollten die Konfidenzintervallgrenzen sein, damit die Nullhypothese wahr ist? [geschlossen]
Geschlossen . Diese Frage erfordert Details oder Klarheit . Derzeit werden keine Antworten akzeptiert. Möchten Sie diese Frage verbessern? Fügen Sie Details hinzu und klären Sie das Problem, indem Sie diesen Beitrag bearbeiten . Geschlossen vor 5 Monaten . Dies ist eine rein hypothetische Frage. Eine sehr verbreitete Aussage ist, …


2
Unterschied zwischen den Sprossen zwei und drei in der Ladder of Causation
In Judea Pearls "Book of Why" spricht er über das, was er als "Ladder of Causation" bezeichnet. Dies ist im Wesentlichen eine Hierarchie, die sich aus verschiedenen Ebenen kausalen Denkens zusammensetzt. Die niedrigste befasst sich mit Assoziationsmustern in beobachteten Daten (z. B. Korrelation, bedingte Wahrscheinlichkeit usw.), die nächste befasst sich …
12 causality 

5
Random Forest- und Decision Tree-Algorithmus
Ein zufälliger Wald ist eine Sammlung von Entscheidungsbäumen, die dem Absackkonzept folgen. Wenn wir von einem Entscheidungsbaum zum nächsten übergehen, wie werden dann die Informationen, die der letzte Entscheidungsbaum gelernt hat, zum nächsten weitergeleitet? Denn meines Wissens gibt es nichts Vergleichbares wie ein trainiertes Modell, das für jeden Entscheidungsbaum erstellt …

1
Ist eine Metaanalyse der Odds Ratios im Wesentlichen hoffnungslos?
In einem kürzlich erschienenen Aufsatz von Norton et al. (2018) [ 1 ] geben an, dass[ 1 ][1]^{[1]} Unterschiedliche Quotenverhältnisse aus derselben Studie können nicht verglichen werden, wenn die statistischen Modelle, die zu Quotenverhältnisschätzungen führen, unterschiedliche erklärende Variablen aufweisen, da jedes Modell einen anderen willkürlichen Skalierungsfaktor hat. Die Größe der …

1
Wie wird eine gleichmäßige Probe von der Oberfläche eines Hyperellipsoids genommen (konstanter Mahalanobis-Abstand)?
Gibt es in einem multivariaten Fall mit realem Wert eine Möglichkeit, die Punkte von der Oberfläche, an denen der Mahalanobis-Abstand vom Mittelwert des eine Konstante ist, gleichmäßig abzutasten? BEARBEITEN: Es geht nur darum, Punkte gleichmäßig von der Oberfläche eines Hyperellipsoids abzutasten, das die Gleichung erfüllt. ( x - μ )TΣ- …

1
Mitteln wir für die Modellmittelung eines GLM die Vorhersagen auf der Link- oder Antwortskala?
Um die modellgemittelten Vorhersagen auf der Antwortskala eines GLM zu berechnen, welche ist "korrekt" und warum? Berechnen Sie die modellgemittelte Vorhersage auf der Verbindungsskala und transformieren Sie sie anschließend auf die Antwortskala zurück Transformieren Sie die Vorhersagen in die Antwortskala und berechnen Sie dann den Modelldurchschnitt Die Vorhersagen sind nahe …

1
Warum wird in Random Forest eine zufällige Teilmenge von Features auf Knotenebene und nicht auf Baumebene ausgewählt?
Meine Frage: Warum werden in zufälligen Gesamtstrukturen zufällige Teilmengen von Features für die Aufteilung auf Knotenebene in jedem Baum berücksichtigt, anstatt auf Baumebene ? Hintergrund: Dies ist so etwas wie eine historische Frage. Tin Kam Ho veröffentlichte diesen Aufsatz über die Konstruktion von "Entscheidungswäldern", indem er 1998 zufällig eine Teilmenge …


1
Was bedeuten die Achsen in t-SNE?
Ich versuche gerade, meinen Kopf um die t-SNE- Mathematik zu wickeln . Leider gibt es noch eine Frage, die ich nicht zufriedenstellend beantworten kann: Was ist die tatsächliche Bedeutung der Achsen in einem t-SNE-Diagramm? Wenn ich zu diesem Thema einen Vortrag halten oder in eine Veröffentlichung aufnehmen würde: Wie würde …


2
Ist es möglich, dass der AIC und der BIC eine völlig unterschiedliche Modellauswahl bieten?
Ich führe ein Poisson-Regressionsmodell mit 1 Antwortvariablen und 6 Kovariaten durch. Die Modellauswahl mit AIC ergibt ein Modell mit allen Kovariaten sowie 6 Interaktionstermen. Der BIC führt jedoch zu einem Modell mit nur 2 Kovariaten und keinen Interaktionstermen. Ist es möglich, dass die beiden Kriterien, die sehr ähnlich aussehen, völlig …

Durch die Nutzung unserer Website bestätigen Sie, dass Sie unsere Cookie-Richtlinie und Datenschutzrichtlinie gelesen und verstanden haben.
Licensed under cc by-sa 3.0 with attribution required.