Statistiken und Big Data

Fragen und Antworten für Personen, die sich für Statistik, maschinelles Lernen, Datenanalyse, Data Mining und Datenvisualisierung interessieren

2
Überprüfen, ob eine Dichte eine exponentielle Familie ist
Der Versuch zu beweisen, dass dies nicht zur exponentiellen Familie gehört. f(y|a)=4(y+a)(1+4a);0&lt;y&lt;1,a&gt;0f(y|a)=4(y+a)(1+4a);0&lt;y&lt;1,a&gt;0f(y|a)=4\frac{(y+a)}{(1+4a)} ; 0 < y < 1 , a>0 Hier ist mein Ansatz: f(y|a)=4(y+a)e−log(1+4a)f(y|a)=4(y+a)e−log(1+4a)f(y|a) = 4(y+a)e^{-log(1+4a)} f(y|a)=(4y)(1+ay)e−log(1+4a)f(y|a)=(4y)(1+ay)e−log(1+4a)f(y|a) = (4y)(1+\frac{a}{y})e^{-log(1+4a)} Wenn man es mit der Standardform vergleicht, kann und die nur eine Funktion von , nicht als allein definiert werden, …

4
Regression von Daten, die ein Datum enthalten
Ich habe einen Datensatz, der einige hundert Transaktionen von drei Lieferanten enthält, die über einen Zeitraum von drei Jahren in über 100 Ländern tätig sind. Wir haben festgestellt, dass das Verkaufsland kein wesentlicher Faktor für die erzielten Preise ist (die Produkte sind mehr oder weniger globale Waren). Alle Preise sind …





2
Gibt es Alternativen zur Simulation zur Bestimmung der Verteilung der Anzahl von Ereignissen aus zwei abhängigen inhomogenen Poisson-Prozessen?
Ein "State of the Art" -Modell für die Verteilung der in einem Fußballspiel erzielten Tore ist das von Dixon und Robinson (1998) "Ein Geburtsprozessmodell für Fußballspiele der Vereinigung", das zwei Schlüsselphänomene erklärt: 1) Am Ende eines Spiels werden mehr Tore erzielt als zu Beginn (vermutlich aufgrund der Müdigkeit beider Mannschaften). …

2
Gruppieren Sie kategoriale Variablen in glmnet
Betrachten Sie die folgende Passform: fit3a=glmnet(x,g4,family="multinomial",type.multinomial="grouped") Wie gebe ich an, welche Spalten xkategorisch / multinomial sind? Gibt es eine Option, um den Index der gruppierten Variablen anzugeben? In der Dokumentation wird die Option type.multinomialwie folgt beschrieben: Wenn "gruppiert", wird eine gruppierte Lasso-Strafe für die multinomialen Koeffizienten für eine Variable verwendet. …

1
Vollständig Bayesianische Hyperparameterauswahl in GPML
Ist es möglich, mit dem GPML-Code eine ungefähre vollständige Bayes'sche (1) Auswahl von Hyperparametern (z. B. Kovarianzskala) durchzuführen, anstatt die Grenzwahrscheinlichkeit zu maximieren (2)? Ich denke, die Verwendung von MCMC-Methoden zur Lösung der Integrale mit Hyperparametern sollte zu besseren Ergebnissen führen, wenn es um Überanpassung geht. Meines Wissens enthält das …

2
Verwenden einer Reihe von binären logistischen Regressionen mit einer kategorialen Multiple-Choice-Antwortvariablen
Ich habe kategorische Umfragedaten zur Einstellung der Menschen zu einem bestimmten Politikbereich aus 13 Ländern. Die Antwortvariable ist kategorisch und enthält 4 verschiedene Antworten, die nicht geordnet werden können. Ich möchte ein mehrstufiges Multinomialmodell mit zufälligem Schnittpunkt und zufälliger Steigung erstellen. Das Problem ist, dass die Anzahl der Fälle der …


2
Quadratische Programmierung, wenn die Matrix nicht positiv bestimmt ist
http://cran.r-project.org/web/packages/quadprog/quadprog.pdf Das R-Paket quadprogscheint in der Lage zu sein, das quadratische Programmierproblem nur zu lösen, wenn die Matrix positiv definit ist.DDD Es gibt jedoch einen Fall, in dem die Matrix nicht eindeutig positiv ist. sowieDDD min(x2+y2−6xy)subject tox+y3x+yx,y≤≤≥1,1.5,0.min(x2+y2−6xy)subject tox+y≤1,3x+y≤1.5,x,y≥0.\begin{eqnarray} \min(x^2 + y^2 - 6xy) \\ \text{subject to}\quad\quad x + y &\leq& …
8 r  optimization 

3
Empfehlungen für mathematische multivariate Statistiken mit Übungen
Ich brauche ein mathematisch strenges Lehrbuch für Hochschulabsolventen über multivariate Analyse und Inferenz, um mich zu verbessern. Ich habe die Elemente des statistischen Lernens gelesen und die darin enthaltenen Probleme gelöst, aber ich brauche ein Buch mit anderen Schwerpunkten. Themen wie berühmte Distributionen (Wishart, Wilks Lambda usw.), Hypothesentests, einige Theorie …

1
Hierarchische Bayes'sche Analyse der Proportionsunterschiede
Warum hierarchisch? : Ich habe versucht, dieses Problem zu untersuchen, und soweit ich weiß, handelt es sich um ein "hierarchisches" Problem, da Sie Beobachtungen über Beobachtungen aus einer Population machen, anstatt direkte Beobachtungen aus dieser Population zu machen. Referenz: http://www.econ.umn.edu/~bajari/iosp07/rossi1.pdf Warum Bayesian? : Außerdem habe ich es als Bayesianisch markiert, …

1
Probleme mit normalem Kriging
Ich habe diesen Wiki- Artikel über gewöhnliches Kriging verfolgt Jetzt sieht meine Kovarianzmatrix für 4 Variablen so aus 1 0.740818220681718 0.548811636094027 0.406569659740599 0.740818220681718 1 0.740818220681718 0.548811636094027 0.548811636094027 0.740818220681718 1 0.740818220681718 0.406569659740599 0.548811636094027 0.740818220681718 1 Nun, die Beziehung zwischen Semvariogramm und Variogramm ist gegeben durch γ(h)/(C0)=1−C(h)/C(0)γ(h)/(C0)=1−C(h)/C(0)\gamma(h)/(C0) = 1 - C(h)/C(0) Also …

Durch die Nutzung unserer Website bestätigen Sie, dass Sie unsere Cookie-Richtlinie und Datenschutzrichtlinie gelesen und verstanden haben.
Licensed under cc by-sa 3.0 with attribution required.