Statistiken und Big Data

Fragen und Antworten für Personen, die sich für Statistik, maschinelles Lernen, Datenanalyse, Data Mining und Datenvisualisierung interessieren

1
Wie werden Gewichte für die WLS-Regression in R bestimmt?
Ich versuche, das Alter als Funktion einer Reihe von DNA-Methylierungsmarkern vorherzusagen. Diese Prädiktoren sind kontinuierlich zwischen 0 und 100. Wenn ich eine OLS-Regression durchführe, kann ich sehen, dass die Varianz mit dem Alter zunimmt. Daher habe ich mich für ein gewichtetes Regressionsmodell entschieden. Ich habe jedoch Probleme bei der Entscheidung, …

2
Filtern gegen Glätten in der Bayes'schen Schätzung
Ich stehe vor einer posterioren Verteilung in einer MCMC- Anwendung, die darauf abzielt, eine nicht beobachtbare Variable bei einer beobachteten Reihe y = \ {y_t \} ^ T_ {t = abzutasten 0} .x={xt}Tt=0x={xt}t=0Tx=\{x_t\}_{t=0}^{T}y={yt}Tt=0y={yt}t=0Ty=\{y_t\}^T_{t=0} Die bedingten Posterioren lauten jedoch p(xt|yt+1,yt,yt−1,xt−1,xt+1,Θ),p(xt|yt+1,yt,yt−1,xt−1,xt+1,Θ),p(x_t | y_{t+1}, y_t, y_{t-1} ,x_{t-1}, x_{t+1}, \Theta), wobei ΘΘ\Theta a ist …

1
Was ist der Mittelwert und die Varianz des Medians einer Menge normaler Zufallsvariablen?
Sei , ..., identisch unabhängig verteilte Zufallsvariablen mitX1X1X_1X.nXnX_nN.( μ ,σ2)N(μ,σ2)N(\mu, \sigma^2) Es ist leicht zu zeigen, dass der Stichprobenmittelwert eine Zufallsvariable mit .X.¯=1n∑ni = 0X.ichX¯=1n∑i=0nXi\bar{X} = \frac{1}{n}\sum^n_{i = 0}{X_i}N.( μ ,σ2n)N(μ,σ2n)N(\mu, \frac{\sigma^2}{n}) Es fällt mir jedoch schwer, die Verteilung des der Stichprobe zu ermitteln , insbesondere in Bezug auf Mittelwert …

2
Was ist probabilistische Folgerung?
Ich lese Chris Bishops Lehrbuch zur Mustererkennung und zum maschinellen Lernen . Ich bin mehrmals auf den Begriff probabilistische Folgerung gestoßen. Ich habe ein paar Fragen. Ist probabilistische Inferenz nur in einem grafischen Modellierungskontext anwendbar? Was ist der Unterschied zwischen traditioneller statistischer Inferenz (p-Werte, Konfidenzintervalle, Bayes-Faktoren usw.) und probabilistischer Inferenz? …

3
Warum wird die isometrische Log-Ratio-Transformation gegenüber dem Additiv (alr) oder der zentrierten (clr) mit Zusammensetzungsdaten bevorzugt?
Ich mache eine lineare Regression für Kompositionsdaten unter Verwendung der Log-Ratio-Transformation mit Volkszählungsdaten. Die IVs sind zusammengesetzt (Prozent summiert sich auf 100). Der DV ist nicht kompositorisch und kontinuierlich. Die alr- und clr-Ergebnisse lassen sich leichter interpretieren. Sie alle erzeugen das gleiche Maß an Passform. Ich bin geneigt, mit alr …



1
Bedeutung des richtigen Prior
Ich versuche, die Grundlagen der Bayes'schen Entscheidung zu lernen, und bin auf den Ausdruck "richtiger Prior" gestoßen, aber ich verstehe nicht wirklich, was das bedeutet. Weiß jemand?
8 prior 



2
Was ist die Intuition hinter einer Indikatorfunktion?
Was ist eine Indikatorfunktion? Was ist die Intuition hinter einer Indikatorfunktion? Warum ist die Anzeigefunktion IAIAI_A im folgenden Beispiel benötigt? Kann das folgende Beispiel ohne Verwendung der Anzeigefunktion umgeschrieben werden? Lassen AAAsei irgendein Ereignis. Wir können schreibenP(A)P(A)\Bbb P(A) als Erwartung wie folgt: Definieren Sie die Anzeigefunktion: IA={1,0,if event A occursotherwiseIA={1,if …


1
So erhalten Sie multivariate glaubwürdige Intervallschätzungen / Regionen mit der höchsten Dichte (HDR) nach MCMC
Ich schätze 15 Parameter meines Modells unter Verwendung eines Bayes'schen Ansatzes und einer Markov-Ketten-Monte-Carlo-Methode (MCMC). Meine Daten nach dem Ausführen einer MCMC-Kette von 100000 Proben sind daher eine 100000 × 15-Tabelle mit Parameterwerten. Ich möchte 15-dimensionale Regionen mit der höchsten Dichte meiner posterioren Verteilung finden. Mein Problem: Das Clustering der …

2
Schätzung der CAPM Beta über OLS Regresson
Ich studiere Ökonometrie aus der dritten Ausgabe von 'Introduction to Econometrics' von James H. Stock und Mark W. Watson. Auf Seite 166 schweift es in das Beta der Aktie ab. Es sagt Diese Betas werden in der Regel durch OLS-Regression der tatsächlichen Überschussrendite der Aktie gegen die tatsächliche Überschussrendite eines …

5
Schritt Änderungserkennung
Ich verwende eine nichtlineare Methode der kleinsten Quadrate, um eine analytische Funktion an einige experimentelle Daten anzupassen. Ich muss dem Algorithmus einige anfängliche Schätzwerte geben, also versuche ich herauszufinden, wie dies automatisch gemacht wird (und nicht mit dem Auge, was ich getan habe). Dies sind einige simulierte Daten, die durch …

Durch die Nutzung unserer Website bestätigen Sie, dass Sie unsere Cookie-Richtlinie und Datenschutzrichtlinie gelesen und verstanden haben.
Licensed under cc by-sa 3.0 with attribution required.