Statistiken und Big Data

Fragen und Antworten für Personen, die sich für Statistik, maschinelles Lernen, Datenanalyse, Data Mining und Datenvisualisierung interessieren


2
Der ökonometrische Text behauptet, dass Konvergenz in der Verteilung Konvergenz in Momenten impliziert
Das folgende Lemma findet sich in Hayashis Ökonometrie : Lemma 2.1 (Konvergenz in Verteilung und in Momenten): Sei der te Moment von und wobei \ alpha_ {s} endlich ist (dh eine reelle Zahl). Dann:αsnαsn\alpha_{sn}sssznznz_{n}limn→∞αsn=αslimn→∞αsn=αs\lim_{n\to\infty}\alpha_{sn}=\alpha_{s}αsαs\alpha_{s} " zn→dzzn→dzz_{n} \to_{d} z " ⟹⟹\implies " αsαs\alpha_{s} ist der sss te Moment von zzz ." …


1
Unterschied zwischen prädiktiv und prognostisch
Ich höre, wie die Begriffe prädiktive und prognostische Faktoren häufig verwendet werden (normalerweise im Zusammenhang mit der Biostatistik), und ich bin mir nicht sicher, was der Unterschied zwischen ihnen ist. Könnte jemand bitte eine Definition von jedem geben, ein Beispiel für die beiden, und letztendlich, wie sie sich voneinander unterscheiden?

2
Verwendung nicht rechteckiger Kernel in Faltungs-Neuronalen Netzen? Besonders bei der Analyse von Spielbrettern
Ich habe einen Stapel von Artikeln über Faltungsnetzwerke und das Lernen der Verstärkung gelesen. Ich erinnere mich an ein wichtiges Papier mit einer nicht rechteckigen Form der Faltungsschicht (die grüne Form in dieser albernen Zeichnung). Aber jetzt kann ich es nicht finden. Es könnte etwas Ähnliches wie das AlphaGo-Papier oder …

3
Online-Varianzschätzung mit begrenztem Speicher
Ich erstelle eine Komponente, die darauf abzielt, den Durchschnitt und die Varianz einer Metrik zu berechnen, die mit Ereignissen verbunden ist, die während der Zeit auftreten, aber mit einem begrenzten internen Speicher. Stellen Sie sich vor, die Ereignisse sind Besucher, die einen Laden betreten, und die Metrik entspricht ihrem Alter. …


3
Wählen Sie die Wahrscheinlichkeitsverteilung, um die Bewertungsfunktion zu maximieren (für den CDC-Grippewettbewerb).
Angenommen, Sie haben eine diskrete Zufallsvariable XXX mit Wahrscheinlichkeitsmassenfunktion p(x)=P(X=x)p(x)=P(X=x)p(x) = P(X=x) auf die Unterstützung 0,…,n0,…,n0,\ldots,n. Welche Funktionq(x)≥0q(x)≥0q(x)\ge 0 so dass ∑nx=0q(x)=1∑x=0nq(x)=1\sum_{x=0}^n q(x) = 1 maximiert E(log[q(X−1)+q(X)+q(X+1)])?E(log⁡[q(X−1)+q(X)+q(X+1)])? E(\log[q(X-1)+q(X)+q(X+1)])? Nehmen Sie an, um den Umgang mit Randfällen zu vermeiden P(X=0)=P(X=n)=0P(X=0)=P(X=n)=0P(X=0)=P(X=n)=0. Verwandte Fragen: Ich glaube das q( x )q(x)q(x) das maximiert die …

1
Wie gruppiert ein U-Net Pixel in einen einzelnen räumlichen Bereich?
Das als " U-Net " bekannte neuronale Netzwerk (Ronneberger, Fischer und Brox 2015) war eine herausragende Technik in Kaggles jüngstem Ultraschall- Nervensegmentierungswettbewerb , bei dem Algorithmen, die Pixelmasken mit einem hohen Grad an Überlappung mit erzeugten, hohe Punktzahlen verliehen wurden die handgezeichneten Regionen. (Foto von Christopher Hefele ) Wenn man …

3
Welche Auswirkungen hat die Verdoppelung einer Stichprobengröße auf einen p-Wert?
Unter der Annahme, dass es sich um eine zugrunde liegende Beziehung zwischen zwei Variablen in einer OLS-Regression handelt [Nullhypothesentest], wie wirkt sich dann die Verdoppelung der Stichprobengröße auf den p-Wert aus? (unter der Annahme, dass die ursprüngliche Stichprobe repräsentativ für die Bevölkerung ist und die nachfolgende Stichprobe ebenfalls repräsentativ ist). …


1
Benötigen Sie immer weniger EXTRA richtige Antworten, um in standardisierten Prüfungen eine Bewertungskurve zu erreichen?
Eine Bewertungskurve des Vorjahres für eine Prüfung, an der ich teilnehmen werde, lautet: Angenommen, die Prüfung enthält 100 (oder eine beliebige Anzahl) Fragen, die jeweils gleich gewichtet sind. Werden weniger zusätzliche richtige Antworten benötigt, um die Perzentile zu erhöhen, wenn Sie sich vom Durchschnitt entfernen? Brauche ich beispielsweise weniger zusätzliche …


1
Sind „Kernel-Methoden“ und „Reproduzieren von Kernel-Hilbert-Räumen“ miteinander verbunden?
Sind "Kernel-Methoden" und "Reproduzieren von Kernel-Hilbert-Räumen" miteinander verbunden? Ist der "Kernel", der im Begriff "Kernel-Methoden" verwendet wird, derselbe (Typ von) "Kernel" wie der, der im Begriff "Reproduzieren des Kernel-Hilbert-Raums" verwendet wird? Beachten Sie, dass ich die Wikipedia-Seiten bereits auf die beiden Themen überprüft habe und auf der Seite keine Erwähnung …

3
Verwenden von PCA für einen Bilddatensatz vor der Klassifizierung mit einem neuronalen Netzwerk
Ich habe eine Bilddatenmatrix X∈RN x pX∈ℜN x pX \in \Re^{N \ \text{x}\ p} wo N=50000N=50000N=50000 ist die Anzahl der Bildbeispiele und p=3072p=3072p=3072 ist die Anzahl der Bildpixel: p=3072=32×32×3p=3072=32×32×3p = 3072 = 32 \times 32 \times 3, weil jedes Bild ein 3-Kanal ist 32×3232×3232 \times 32Bild. Darüber hinaus gehört jedes …

Durch die Nutzung unserer Website bestätigen Sie, dass Sie unsere Cookie-Richtlinie und Datenschutzrichtlinie gelesen und verstanden haben.
Licensed under cc by-sa 3.0 with attribution required.