Statistiken und Big Data

Fragen und Antworten für Personen, die sich für Statistik, maschinelles Lernen, Datenanalyse, Data Mining und Datenvisualisierung interessieren

2
Wie wird aus der diskreten Verteilung auf die nicht negativen ganzen Zahlen abgetastet?
Ich habe die folgende diskrete Verteilung, wobei bekannte Konstanten sind:α , βα,β\alpha,\beta p ( x ; α , β) = Beta ( α + 1 , β+ x )Beta ( α , β)für x = 0 , 1 , 2 , …p(x;α,β)=Beta(α+1,β+x)Beta(α,β)for x=0,1,2,… p(x;\alpha,\beta) = \frac{\text{Beta}(\alpha+1, \beta+x)}{\text{Beta}(\alpha,\beta)} \;\;\;\;\text{for } x …

4
Interpretation des AIC-Wertes
Typische AIC-Werte, die ich für Logistikmodelle gesehen habe, sind Tausende, mindestens Hunderte. zB auf http://www.r-bloggers.com/how-to-perform-a-logistic-regression-in-r/ beträgt der AIC 727,39 Während immer gesagt wird, dass AIC nur zum Vergleichen von Modellen verwendet werden sollte, wollte ich verstehen, was ein bestimmter AIC-Wert bedeutet. Gemäß der Formel ist A ichC.= - 2 log( …


1
Topologien, für die das Ensemble der Wahrscheinlichkeitsverteilungen vollständig ist
Ich hatte einige Probleme damit, mein intuitives Verständnis von Wahrscheinlichkeitsverteilungen mit den seltsamen Eigenschaften in Einklang zu bringen, die fast alle Topologien von Wahrscheinlichkeitsverteilungen besitzen. Betrachten Sie beispielsweise eine gemischte Zufallsvariable : Wählen Sie einen bei 0 zentrierten Gaußschen Wert mit der Varianz 1 aus und addieren Sie mit der …

3
Randomisierung der nicht zufälligen Stichprobe
Ich bin immer ein bisschen überrascht, psychologische Anzeigen für die Teilnahme an experimentellen Studien zu sehen. Personen, die auf diese Anzeigen antworten, werden nicht zufällig ausgewählt und sind daher eine selbst ausgewählte Population. Da bekannt ist, dass die Randomisierung das Selbstauswahlproblem löst, habe ich mich gefragt, ob die Randomisierung einer …

1
Welche Frage beantwortet ANOVA?
Ich möchte ANOVA lernen. Bevor ich lerne, wie der Algorithmus funktioniert (welche Berechnungen müssen durchgeführt werden) und warum er funktioniert, möchte ich zunächst wissen, welches Problem wir tatsächlich mit ANOVA lösen oder welche Antwort wir zu beantworten versuchen. Mit anderen Worten: Was ist Eingabe und was ist Ausgabe des Algorithmus? …
9 anova 

3
Wenn und , ist ?
Dies sind keine Hausaufgaben. Sei XXX eine Zufallsvariable. Wenn E[X]=k∈RE[X]=k∈R\mathbb{E}[X] = k \in \mathbb{R} und Var[X]=0Var[X]=0\text{Var}[X] = 0 , folgt dann Pr(X=k)=1Pr(X=k)=1\Pr\left(X = k\right) = 1 ? Intuitiv scheint dies offensichtlich, aber ich bin mir nicht sicher, wie ich es beweisen würde. Ich weiß sicher, dass aus den Annahmen \ …

2
Der Engpass bei der Anwendung von Deep Learning in der Praxis
Nach dem Lesen vieler Deep-Learning-Artikel besteht eine Art raues Gefühl darin, dass es viele Tricks gibt, das Netzwerk zu trainieren, um eine überdurchschnittliche Leistung zu erzielen. Aus Sicht der Branchenanwendungen ist es sehr schwierig, diese Art von Tricks zu entwickeln, mit Ausnahme der Elite-Forschungsgruppen in großen Technologieunternehmen, z. B. Google …


1
Asymptotische Normalität der Ordnungsstatistik von Schwerschwanzverteilungen
Hintergrund: Ich habe ein Beispiel, das ich mit einer starken Schwanzverteilung modellieren möchte. Ich habe einige Extremwerte, so dass die Verbreitung der Beobachtungen relativ groß ist. Meine Idee war es, dies mit einer verallgemeinerten Pareto-Verteilung zu modellieren, und das habe ich auch getan. Jetzt ist das 0,975-Quantil meiner empirischen Daten …


1
Sind Konturen interessante Merkmale einer Funktion die durch Regression erhalten werden?
Ich von einem allgemeinen Regressionsaufbau aus, einer stetigen Funktion wird aus einer Familie , um den gegebenen Daten ( kann ein beliebiger Raum wie Würfel oder tatsächlich ein vernünftiger topologischer Raum sein) nach einigen natürlichen Kriterien.hθ:X→Rnhθ:X→Rnh_\theta:X\to \mathbb R^n{hθ}θ{hθ}θ\{h_\theta\}_\theta(xi,yi)∈X×Rn,i=1,…,k(xi,yi)∈X×Rn,i=1,…,k(x_i,y_i)\in X\times \mathbb R^n, i=1,\ldots, kXXX[0,1]m[0,1]m[0,1]^m Gibt es Regressionsanwendungen, bei denen man an …

2
In welchen wissenschaftlichen Bereichen wird untersucht, wie Menschen quantitative Zusammenfassungen und Visualisierungen interpretieren?
Es gibt eine Fülle bekannter Ressourcen, die Ratschläge zur Datenvisualisierung geben. (ZB Tufte, Stephen Few et al. , Nathan Yau .) Aber an welche Bereiche könnte man sich wenden, um Antworten auf Fragen wie diese zu erhalten: Ist die Tortendiagrammkritik in der Praxis relevant? Können Menschen die lineare Skalenlänge so …

1
Was sollte ein Abschlusskurs in experimentellem Design beinhalten?
Ich wurde gebeten, einen Kurs in experimentellem Design für fortgeschrittene Doktoranden in Agronomie und Ökologie vorzuschlagen. Ich habe noch nie an einem solchen Kurs teilgenommen und war überrascht, dass der Kurs möglicherweise passender als "Beyond One-Way-ANOVA" bezeichnet wird und Material abdeckt, das ich in einem fortgeschrittenen Graduiertenkurs über Statistik für …


Durch die Nutzung unserer Website bestätigen Sie, dass Sie unsere Cookie-Richtlinie und Datenschutzrichtlinie gelesen und verstanden haben.
Licensed under cc by-sa 3.0 with attribution required.