Statistiken und Big Data

Fragen und Antworten für Personen, die sich für Statistik, maschinelles Lernen, Datenanalyse, Data Mining und Datenvisualisierung interessieren

2
Wie können Differenzvariablen in DAGs korrekt dargestellt werden?
Wenn ich an den kausalen Auswirkungen der Änderung einer Variablen ( ) auf ein Ergebnis ( ) interessiert bin , wie würde ich das in einem gerichteten azyklischen Graphen (DAG) darstellen?EEEOOO Angenommen, , wobei & zu den Zeitpunkten 1 & 2 auftreten, wäre eine korrekte DAG: Δ E2= E.2- E.1ΔE2=E2−E1\Delta …

1
Interpretation von Regressionskoeffizienten basierend auf Andrew Gelmans Neuskalierungsmethode
Ich habe zwei Prädiktoren in einem binären logistischen Regressionsmodell: einen binären und einen kontinuierlichen. Mein primäres Ziel ist es, die Koeffizienten der beiden Prädiktoren innerhalb desselben Modells zu vergleichen. Ich bin auf Andrew Gelmans Vorschlag gestoßen, Eingabevariablen für die kontinuierliche Regression zu standardisieren: I) Ursprünglicher Vorschlag (2008): Teilen Sie den …

2
Adaptive Auswahl der Anzahl der Bootstrap-Replikate
Wie bei den meisten Monte-Carlo-Methoden lautet die Regel für das Bootstrapping: Je größer die Anzahl der Replikate ist, desto geringer ist der Monte-Carlo-Fehler. Da die Renditen jedoch abnehmen, ist es nicht sinnvoll, so viele Replikate wie möglich auszuführen. Angenommen, Sie möchten sicherstellen, dass Ihre Schätzung θ^θ^\hat θ einer bestimmten Größe …
8 bootstrap 

1
Support Vector Machines (SVMs) sind die Nulltemperaturgrenze der logistischen Regression?
Ich hatte kürzlich eine kurze Diskussion mit einem sachkundigen Freund, der erwähnte, dass SVMs die Nulltemperaturgrenze der logistischen Regression sind. Das Grundprinzip umfasste marginale Polytope und Fenchel-Dualität. Ich konnte nicht folgen. Ist diese Aussage über SVMs als Nulltemperaturgrenze der logistischen Regression wahr? Und wenn ja, kann jemand das Argument beschreiben?


1
Vorhersageintervalle für das Ergebnis einer logistischen Regression mit binomialer Antwort
Angenommen, wir haben ein logistisches Regressionsmodell: P.( y= 1 | x )Log( p1 - p)= p= β xP(y=1|x)=plog⁡(p1−p)=βx\begin{align} P(y=1\vert\mathbf{x}) &= p \\ \log\left(\frac{p}{1-p}\right) &= \boldsymbol{\beta}\mathbf{x} \end{align} Bei einer Zufallsstichprobe D = { X , y }D={X,y}D=\{\mathbf{X},\mathbf{y}\} der Größe N.NN können wir Konfidenzintervalle für das ββ\boldsymbol{\beta} und entsprechend Vorhersageintervalle für ppp …


3
Was ist das Schlimmste, was passieren kann, wenn die Annahme der Homoskedastizität in ANOVA verletzt wird?
Dies ist eine Folgefrage, die ich nach Durchsicht dieses Beitrags habe: Unterschied im Mittelwert des statistischen Tests für nicht normale, heteroskedastische Daten? Um klar zu sein, frage ich aus einer pragmatischen Perspektive (um nicht zu suggerieren, dass theoretische Antworten nicht erwünscht sind). Wenn Normalität zwischen den Gruppen ist vorhanden (aus …

2
Kann
Die Wikipedia-Seite auf R2 sagt, dass einen Wert größer als 1 annehmen kann. Ich sehe nicht, wie dies möglich ist.R.2R2R^2 Werte von außerhalb des Bereichs 0 bis 1 können auftreten, wenn sie zur Messung der Übereinstimmung zwischen beobachteten und modellierten Werten verwendet werden und wenn die "modellierten" Werte nicht durch …


1
Verteilung von
Ich arbeite an folgendem Problem: Sei und unabhängige Zufallsvariablen mit gemeinsamer Dichte wobei . Sei und V = \ max (X, Y) . Hier finden Sie die gemeinsame Dichte von (U, V) und damit die pdf von finden U + V .XXXYYYf(x)=αβ−αxα−110&lt;x&lt;βf(x)=αβ−αxα−110&lt;x&lt;βf(x)=\alpha\beta^{-\alpha}x^{\alpha-1}\mathbf1_{0<x<\beta}α⩾1α⩾1\alpha\geqslant1U=min(X,Y)U=min(X,Y)U=\min(X,Y)V=max(X,Y)V=max(X,Y)V=\max(X,Y)(U,V)(U,V)(U,V)U+VU+VU+V Da U+V=X+YU+V=X+YU+V=X+Y , kann ich einfach das PDF …

1
Folgen Zufallsvariablen denselben algebraischen Regeln wie gewöhnliche Zahlen?
In den Kommentaren zu meiner Antwort auf eine kürzlich gestellte Frage zur Summe der Zufallsvariablen stieß ich auf einen Link zum Wikipedia-Artikel über die Verhältnisverteilung und bemerkte dort die folgende besondere Behauptung: Die mit gewöhnlichen Zahlen bekannten algebraischen Regeln gelten nicht für die Algebra von Zufallsvariablen. Wenn beispielsweise ein Produkt …


1
Warum konvergiert MAP zu MLE?
In Kevin Murphys "Maschinelles Lernen: Eine probabilistische Perspektive", Kapitel 3.2, demonstriert der Autor das Bayes'sche Konzeptlernen an einem Beispiel namens "Zahlenspiel": Nachdem wir Proben aus , wollen wir Wählen Sie eine Hypothese die die Regel, die die Stichproben generiert hat, am besten beschreibt. Zum Beispiel "gerade Zahlen" oder "Primzahlen".{ 1 …

2
Was ist die Ausgabe eines tf.nn.dynamic_rnn ()?
Ich bin mir nicht sicher, was ich aus der offiziellen Dokumentation verstehe, in der es heißt: Rückgabe: Ein Paar (Ausgänge, Status) wobei: outputs: Der RNN-Ausgangstensor. Wenn time_major == False(Standard), ist dies eine Tensorform : [batch_size, max_time, cell.output_size]. Wenn time_major == Truedies ein Tensor ist : [max_time, batch_size, cell.output_size]. Wenn cell.output_sizees …

Durch die Nutzung unserer Website bestätigen Sie, dass Sie unsere Cookie-Richtlinie und Datenschutzrichtlinie gelesen und verstanden haben.
Licensed under cc by-sa 3.0 with attribution required.