Statistiken und Big Data

Fragen und Antworten für Personen, die sich für Statistik, maschinelles Lernen, Datenanalyse, Data Mining und Datenvisualisierung interessieren


2
Intuitive Erklärung der Stationarität
Ich habe eine Weile mit der Stationarität in meinem Kopf gerungen ... Denkst du so darüber nach? Alle Kommentare oder weitere Gedanken werden geschätzt. Bei stationären Prozessen werden Zeitreihenwerte so generiert, dass das Verteilungsmittel und die Varianz konstant bleiben. Genau genommen ist dies als schwache Form der Stationarität oder Kovarianz …


3
CDF zur Macht erhoben?
Wenn FZFZF_Z eine CDF ist, sieht es so aus, als wäre ( ) ebenfalls eine CDF.FZ(z)αFZ(z)αF_Z(z)^\alphaα>0α>0\alpha \gt 0 F: Ist das ein Standardergebnis? F: Gibt es einen guten Weg , um eine Funktion zu finden mit st , wobeiX ≡ g ( Z )gggX≡g(Z)X≡g(Z)X \equiv g(Z)FX(x)=FZ(z)αFX(x)=FZ(z)αF_X(x) = F_Z(z)^\alphax≡g(z)x≡g(z) x \equiv …


7
Sind kurze Zeitreihen eine Modellierung wert?
Hier ist ein Zusammenhang. Ich möchte herausfinden, wie sich zwei Umgebungsvariablen (Temperatur, Nährstoffgehalt) über einen Zeitraum von 11 Jahren auf den Mittelwert einer Antwortvariablen auswirken. Innerhalb eines Jahres gibt es Daten von über 100.000 Standorten. Ziel ist es zu bestimmen, ob der Mittelwert der Antwortvariablen über den Zeitraum von 11 …

1
Wann möchte man AdaBoost nutzen?
Da ich von dem AdaBoost-Klassifikator gehört habe, der bei der Arbeit wiederholt erwähnt wurde, wollte ich ein besseres Gefühl dafür bekommen, wie es funktioniert und wann man es verwenden möchte. Ich habe eine Reihe von Artikeln und Tutorials darüber gelesen, die ich bei Google gefunden habe, aber es gibt Aspekte …

1
Scrambling und Korrelation in Sequenzen mit geringer Diskrepanz (Halton / Sobol)
Ich arbeite derzeit an einem Projekt, in dem ich Zufallswerte mithilfe von quasi-zufälligen Punktmengen mit geringer Diskrepanz generiere , z. B. Halton- und Sobol-Punktmengen. Dies sind im Wesentlichen ddd dimensionale Vektoren, die eine ddd dimensionale einheitliche (0,1) Variable imitieren , jedoch eine bessere Streuung aufweisen. Theoretisch sollen sie dazu beitragen, …



2
Methoden zum Zusammenführen / Reduzieren von Kategorien in Ordnungs- oder Nominaldaten?
Ich habe Mühe, eine Methode zu finden, um die Anzahl der Kategorien in nominalen oder ordinalen Daten zu reduzieren. Angenommen, ich möchte ein Regressionsmodell für ein Dataset erstellen, das eine Reihe von nominalen und ordinalen Faktoren enthält. Während ich mit diesem Schritt keine Probleme habe, stoße ich häufig auf Situationen, …


4
Kann ich die Angebotsverteilung in MH MCMC nach dem Zufallsprinzip ändern, ohne dass dies Auswirkungen auf Markovianity hat?
Zufallsspaziergang Metropolis-Hasitings mit symmetrischem Vorschlag q(x|y)=g(|y−x|)q(x|y)=g(|y−x|)q(x|y)= g(|y-x|) hat die Eigenschaft, dass die Akzeptanzwahrscheinlichkeit P(accept y)=min{1,f(y)/f(x)}P(accept y)=min{1,f(y)/f(x)}P(accept\ y) = \min\{1, f(y)/f(x)\} hängt nicht vom Vorschlag g(⋅)g(⋅)g(\cdot) . Bedeutet das, dass ich das g(⋅)g(⋅)g(\cdot) in Abhängigkeit von der vorherigen Leistung der Kette ändern kann , ohne die Markovianität der Kette zu beeinträchtigen? …

3
Gewichte lernen in einer Boltzmann-Maschine
Ich versuche zu verstehen, wie Boltzmann-Maschinen funktionieren, bin mir aber nicht sicher, wie Gewichte gelernt werden, und habe keine eindeutige Beschreibung gefunden. Ist das Folgende richtig? (Auch Hinweise auf gute Boltzmann-Maschinenerklärungen wären toll.) Wir haben eine Reihe von sichtbaren Einheiten (z. B. entsprechend schwarz / weißen Pixeln in einem Bild) …

1
Was ist der erwartete Wert einer modifizierten Dirichlet-Verteilung? (Integrationsproblem)
Es ist einfach, eine Zufallsvariable mit Dirichlet-Verteilung unter Verwendung von Gamma-Variablen mit demselben Skalenparameter zu erzeugen. Wenn: Xi∼Gamma(αi,β)Xi∼Gamma(αi,β) X_i \sim \text{Gamma}(\alpha_i, \beta) Dann: (X1∑jXj,…,Xn∑jXj)∼Dirichlet(α1,…,αn)(X1∑jXj,…,Xn∑jXj)∼Dirichlet(α1,…,αn) \left(\frac{X_1}{\sum_j X_j},\; \ldots\; , \frac{X_n}{\sum_j X_j}\right) \sim \text{Dirichlet}(\alpha_1,\;\ldots\;,\alpha_n) Problem Was passiert, wenn die Skalenparameter nicht gleich sind? Xi∼Gamma(αi,βi)Xi∼Gamma(αi,βi) X_i \sim \text{Gamma}(\alpha_i, \beta_i) Wie ist dann die …

Durch die Nutzung unserer Website bestätigen Sie, dass Sie unsere Cookie-Richtlinie und Datenschutzrichtlinie gelesen und verstanden haben.
Licensed under cc by-sa 3.0 with attribution required.