Statistiken und Big Data

Fragen und Antworten für Personen, die sich für Statistik, maschinelles Lernen, Datenanalyse, Data Mining und Datenvisualisierung interessieren

2
Was können wir über Modelle zu Beobachtungsdaten ohne Instrumente sagen?
In der Vergangenheit wurden mir einige Fragen zu veröffentlichten Artikeln in einer Reihe von Bereichen gestellt, in denen Regressionen (und verwandte Modelle wie Panelmodelle oder GLMs) für Beobachtungsdaten verwendet werden (dh Daten, die nicht durch kontrollierte Experimente erzeugt wurden in vielen Fällen - aber nicht immer - Daten, die im …


1
Warum verwendet das Elo-Bewertungssystem eine falsche Aktualisierungsregel?
Das Elo-Bewertungssystem verwendet einen Gradientenabstiegsminimierungsalgorithmus der Kreuzentropieverlustfunktion zwischen der erwarteten und der beobachteten Wahrscheinlichkeit eines Ergebnisses in gepaarten Vergleichen. Wir können die allgemeinen Verlustfunktionen als schreiben E=−∑n,ipiLog(qi)E=−∑n,ipiLog(qi) E=-\sum_{n,i} p_i Log (q_i) wobei die Summe über alle Ergebnisse und alle Gegner . ist die beobachtete Frequenz des Ereignisses und die erwartete …

1
Grundlegendes zur Verwendung von Logarithmen im TF-IDF-Logarithmus
Ich habe gelesen: https://en.wikipedia.org/wiki/Tf%E2%80%93idf#Definition Aber ich kann nicht genau verstehen, warum die Formel so konstruiert wurde, wie sie ist. Was ich tue Verstehe: iDF sollte auf einer bestimmten Ebene messen, wie häufig ein Begriff S in jedem der Dokumente vorkommt, wobei der Wert abnimmt, wenn der Begriff häufiger vorkommt. Aus …

2
Wann konvergieren die Annäherungen der Taylor-Reihen an die Erwartungen (ganzer) Funktionen?
Nehmen Sie eine Erwartung der Form für eine univariate Zufallsvariable und eine gesamte Funktion (dh das Konvergenzintervall ist die gesamte reelle Linie).E(f(X))E(f(X))E(f(X))XXXf(⋅)f(⋅)f(\cdot) Ich habe eine Momenterzeugungsfunktion für und kann daher leicht ganzzahlige Momente berechnen. Verwenden Sie eine Taylor-Reihe um und wenden Sie dann die Erwartung in Form einer Reihe zentraler …



3
Kann ein neuronales Netzwerk eine Funktion und ihre funktionale Ableitung lernen?
Ich verstehe, dass neuronale Netze (NNs) unter bestimmten Voraussetzungen (sowohl für das Netz als auch für die zu approximierende Funktion) als universelle Approximatoren für beide Funktionen und ihre Ableitungen angesehen werden können. Tatsächlich habe ich eine Reihe von Tests mit einfachen, aber nicht trivialen Funktionen (z. B. Polynomen) durchgeführt, und …


1
Modellmatrizen für Modelle mit gemischten Effekten
In der lmerFunktion in lme4in Rgibt es einen Aufruf zum Erstellen einer Modellmatrix von Zufallseffekten , wie hier auf den Seiten 7 bis 9 erläutert .ZZZ Die Berechnung von beinhaltet KhatriRao- und / oder Kronecker-Produkte aus zwei Matrizen, J_i und X_i . ZZZJiJiJ_iXiXiX_i Die Matrix JiJiJ_i ist ein Schluck: "Indikatormatrix …

4
Ist das richtig ? (Erzeugen eines abgeschnittenen norm-multivariaten Gaußschen)
Wenn X∈Rn, X∼N(0–,σ2I)X∈Rn, X∼N(0_,σ2I)X\in\mathbb{R}^n,~X\sim \mathcal{N}(\underline{0},\sigma^2\mathbf{I}) dh fX(x)=1(2πσ2)n/2exp(−||x||22σ2)fX(x)=1(2πσ2)n/2exp⁡(−||x||22σ2) f_X(x) = \frac{1}{{(2\pi\sigma^2)}^{n/2}} \exp\left(-\frac{||x||^2}{2\sigma^2}\right) Ich möchte eine analoge Version einer abgeschnittenen Normalverteilung in einem multivariaten Fall. Genauer gesagt möchte ich ein normbeschränktes (auf einen Wert ≥a≥a\geq a ) multivariates Gaußsches YYY st erzeugen . f X ( y ) , wenn | | …

1
Warum hat ein Stichprobenanteil nicht auch eine Binomialverteilung?
In einer Binomialeinstellung ist die Zufallsvariable X, die die Anzahl der Erfolge angibt, binomial verteilt. Der Stichprobenanteil kann dann als X berechnet werden wobeinIhre Stichprobengröße ist. Mein Lehrbuch besagt dasX.nXn\frac{X}{n}nnn Dieser Anteil hat keine Binomialverteilung jedoch seit ist einfach eine skalierte Version einer binomial verteilten ZufallsvariablenX, sollte sie nicht auch …

1
Warum erklären alle PLS-Komponenten zusammen nur einen Teil der Varianz der Originaldaten?
Ich habe einen Datensatz bestehend aus 10 Variablen. Ich habe partielle kleinste Quadrate (PLS) ausgeführt, um eine einzelne Antwortvariable anhand dieser 10 Variablen vorherzusagen, 10 PLS-Komponenten extrahiert und dann die Varianz jeder Komponente berechnet. Auf den Originaldaten habe ich die Summe der Varianzen aller Variablen genommen, die 702 ist. Dann …

1
Wie funktioniert die Kriging-Interpolation?
Ich arbeite an einem Problem, bei dem ich Kriging verwenden muss, um den Wert einiger Variablen basierend auf einigen umgebenden Variablen vorherzusagen. Ich möchte den Code selbst implementieren. Ich habe zu viele Dokumente durchgesehen, um zu verstehen, wie es funktioniert, aber ich war so verwirrt. Im Allgemeinen verstehe ich, dass …

2
Bedeutet konvexe Ordnung eine Dominanz des rechten Schwanzes?
Angesichts zweier kontinuierlicher Verteilungen und ist mir nicht klar, ob das Verhältnis der konvexen Dominanz zwischen ihnen:FXFX\mathcal{F}_XFYFY\mathcal{F}_Y (0)FX&lt;cFY(0)FX&lt;cFY(0)\quad \mathcal{F}_X <_c \mathcal{F}_Y impliziert, dass (1)F−1Y(q)≤F−1X(q),∀q∈[0.5,1](1)FY−1(q)≤FX−1(q),∀q∈[0.5,1](1)\quad F_Y^{-1}(q) \leq F_X^{-1}(q),\quad \forall q\in[0.5,1] gilt oder ob eine weitere Hypothese erforderlich ist, wenn gelten soll?(1)(1)(1) Definition der konvexen Dominanz. Wenn zwei kontinuierliche Verteilungen und erfüllen:FXFX\mathcal{F}_XFYFY\mathcal{F}_Y …

Durch die Nutzung unserer Website bestätigen Sie, dass Sie unsere Cookie-Richtlinie und Datenschutzrichtlinie gelesen und verstanden haben.
Licensed under cc by-sa 3.0 with attribution required.