Statistiken und Big Data

Fragen und Antworten für Personen, die sich für Statistik, maschinelles Lernen, Datenanalyse, Data Mining und Datenvisualisierung interessieren

2
Warum ist der Autoencoder-Decoder normalerweise die umgekehrte Architektur als Encoder?
Jede Autoencoder-Architektur, die ich gesehen habe, hat eine ähnliche Architektur, hauptsächlich, dass der Decoder genau das Gegenteil des Encoders ist. Wenn das Ziel des Autoencoders das Lernen von niedrigdimensionalen Merkmalen ist, warum ist der Decoder nicht einfach? Ein Beispiel wäre eine lineare Transformation wobei eine Beobachtung durch die Merkmalsmatrix (dh …

3
Warum tauschen Menschen kein Signifikanzniveau gegen Macht?
Als Konvention haben wir viele Studien, deren Signifikanzniveau ist 0.050.050.05und eine Potenz von . Es ist jedoch äußerst selten, eine Studie zu finden, deren mit einer Potenz von .0.80.80.8α=0.2α=0.2\alpha = 0.20.950.950.95 Nach meinem Verständnis spielt das Signifikanzniveau nach Durchführung eines Experiments überhaupt keine Rolle, wenn das Ergebnis nicht signifikant ist, …


1
Wie viele Momente definieren eine Distribution mit endlicher Unterstützung eindeutig?
Einfache Frage, aber eine, auf die ich anderswo keine genaue Antwort finden konnte. Wie viele Momente einer diskreten Wahrscheinlichkeitsverteilung mit endlicher Unterstützung sind erforderlich, um die genaue Wahrscheinlichkeitsmassenfunktion eindeutig zu identifizieren? Angenommen, wir wissen, dass die Verteilung höchstens Punkte innerhalb eines begrenzten Intervalls unterstützt (für meine Zwecke ist das Intervall …

2
Argument zu Interaktionen im Buch des Warum
Es gibt einen Absatz über Interaktionen in The Book of Why (Pearl & Mackenzie, 2018), Kapitel 9 (Ich kann die Seitenzahl nicht teilen, weil ich das Buch im Epub-Format habe), in dem die Autoren argumentieren, dass: Gleichung 9.4 gilt jedoch automatisch in einer Situation, ohne dass offensichtlich Kontrafakten aufgerufen werden …


1
Ist es angemessen, eine zufällige Steigung zu schätzen, ohne die mittlere Gesamtsteigung zu schätzen?
Ich versuche abzuschätzen, ob es Unterschiede gibt, wie Personen in verschiedenen Städten (meine Gruppierungsvariable) auf einige Prädiktorvariablen reagieren. In der Praxis bin ich also daran interessiert, etwas über das zu lernenββ\betas aus jeder Stadt. Ich möchte jedoch zufällige Steigungen verwenden, damit diese Schätzungen in Richtung eines Gruppenmittelwerts "geschrumpft" werden. Ich …


2
Was macht die lineare Regression mit Polynommerkmalen kurvig?
Das Folgende ist mein Verständnis dessen, was passiert: Wenn ich ein "zweidimensionales Problem" nehme, z. B. habe ich als Eingabe und Y als Ergebnis und füge ein Merkmal . Dies gibt einem Problem eine zusätzliche Dimension und die lineare Anpassung an die und Werte definiert eine Linie sowie die lineare …

2
Wie ist die Verteilung der Differenz zweier nicht zentraler Student t-Variablen?
Lassen X1X1X_1 und X2X2X_2 iid nicht zentrale t Zufallsvariablen sein. Ich interessiere mich für die Frage: Was ist die Verteilung von X1−X2X1−X2X_1 - X_2? dh wie ist die Verteilung der Differenz zweier nicht zentraler Student t-Variablen? Annehmen ddd ist eine beobachtete Schätzung für beide X1X1X1 oder X2X2X2im RCode die Wahrscheinlichkeitsfunktion …

3
Wie finde ich Schätzungen der maximalen Wahrscheinlichkeit eines ganzzahligen Parameters?
HW Frage : x1,x2, … ,xnx1,x2,…,xnx_1,x_2,\ldots,x_n sind unabhängige Gaußsche Variablen mit Mittelwert und Varianz . Definiere wobei unbekannt ist. Wir sind an einer Schätzung von aus interessiert .μμ\muσ2σ2\sigma^2y=∑N.n = 1xny=∑n=1N.xny = \sum_{n=1}^{N} x_nN.N.NN.N.Nyyy ein. Wenn bestimmen Sie seine Vorspannung und Varianz.N.^1= y/ μN.^1=y/.μ\hat N_1 = y/\mu b. Wenn bestimmen Sie …

1
Berechnung des erwarteten Wertes der abgeschnittenen Normalen
Unter Verwendung der Mühlen - Verhältnis Ergebnis lassen , dannX.∼ N.( μ ,σ2)X.∼N.(μ,σ2)X \sim N(\mu, \sigma^2) E.( X.| X.&lt; α ) = μ - σϕ (a - μσ)Φ (a - μσ)E.(X.|X.&lt;α)=μ- -σϕ(ein- -μσ)Φ(ein- -μσ)E(X| X<\alpha) = \mu - \sigma\frac{\phi(\frac{a- \mu}{\sigma})}{\Phi(\frac{a-\mu}{\sigma})} Bei der Berechnung in R. erhalte ich jedoch nicht die …


2
Warum sind rohe Residuen der kleinsten Quadrate in der linearen Regression heteroskedastisch?
In meinen Kursnotizen zu einem Regressionskurs zum Nachweis von Heteroskedastizität steht folgendes Zitat: "Da die Residuen der kleinsten Quadrate selbst im homoskedastischen Fall ungleiche Varianzen aufweisen, ist es vorzuziehen, die standardisierten Residuen zu verwenden." Meine Intuition sagt mir, dass die LS-Regressionslinie, da sie notwendigerweise durch die Mitte der Datenwolke verläuft, …

2
Wie passt man am leichtesten über?
Das ist eine seltsame Frage, ich weiß. Ich bin nur ein Neuling und versuche, etwas über verschiedene Klassifikatoroptionen und deren Funktionsweise zu lernen. Also stelle ich die Frage: Bei einem Datensatz mit n1-Dimensionen und n2-Beobachtungen, bei dem jede Beobachtung in n3-Buckets klassifiziert werden kann, erzeugt dieser Algorithmus am effizientesten (idealerweise …

Durch die Nutzung unserer Website bestätigen Sie, dass Sie unsere Cookie-Richtlinie und Datenschutzrichtlinie gelesen und verstanden haben.
Licensed under cc by-sa 3.0 with attribution required.