Statistiken und Big Data

Fragen und Antworten für Personen, die sich für Statistik, maschinelles Lernen, Datenanalyse, Data Mining und Datenvisualisierung interessieren



3
Wie ordne ich 2D-Daten neu an, um eine Korrelation zu erhalten?
Ich habe den folgenden einfachen Datensatz mit zwei kontinuierlichen Variablen; dh: d = data.frame(x=runif(100,0,100),y = runif(100,0,100)) plot(d$x,d$y) abline(lm(y~x,d), col="red") cor(d$x,d$y) # = 0.2135273 Ich muss die Daten so umordnen, dass die Korrelation zwischen Variablen ~ 0,6 beträgt. Ich muss die Mittelwerte und andere beschreibende Statistiken (sd, min, max usw.) Beide …
9 r  correlation 

1
Wie berechnet man die Wahrscheinlichkeitsfunktion?
Die Lebensdauer von 3 elektronischen Bauteilen und . Die Zufallsvariablen wurden als Zufallsstichprobe der Größe 3 aus der Exponentialverteilung mit dem Parameter modelliert . Die Wahrscheinlichkeitsfunktion ist fürX 3 = 2,1 & thgr ; & thgr ; > 0X1=3,X2=1.5,X1=3,X2=1.5,X_{1} = 3, X_{2} = 1.5,X3=2.1X3=2.1X_{3} = 2.1θθ\thetaθ>0θ>0\theta > 0 f3(x|θ)=θ3exp(−6.6θ)f3(x|θ)=θ3exp(−6.6θ)f_{3}(x|\theta) = …




1
Anpassung eines heteroskedastischen verallgemeinerten linearen Modells für Binomialantworten
Ich habe Daten aus dem folgende experimentellen Design: meine Beobachtungen zählen die Anzahl der Erfolge sind ( K) aus Anzahl der Versuche von entsprechenden ( N), gemessen für zwei Gruppen von jeweils umfassten IIndividuen, von TBehandlungen, wobei in jeder solchen Faktorkombination gibt es RReplikate . Insgesamt habe ich also 2 …

1
Wie teste ich den Median einer Population?
Ich habe eine Stichprobe von 250 Einheiten. Die Verteilung ist asymmetrisch. Ich möchte eine Hypothese testen, dass der Median der Bevölkerung von 3,5 abweicht, daher halte ich einen Test mit einer Stichprobe für angemessen. Ich weiß, dass der Wilcoxon-Rang-Test nicht angemessen ist, da die Verteilung nicht symmetrisch ist. Ist ein …


1
Konfidenzintervall für den durchschnittlichen Behandlungseffekt aus der Neigungsbewertung?
Ich versuche, den durchschnittlichen Behandlungseffekt anhand von Beobachtungsdaten mithilfe der Neigungsbewertung (speziell IPTW) abzuschätzen. Ich denke, ich berechne die ATE korrekt, aber ich weiß nicht, wie ich das Konfidenzintervall der ATE unter Berücksichtigung der inversen Neigungsbewertungsgewichte berechnen soll. Hier ist die Gleichung, die ich zur Berechnung des durchschnittlichen Behandlungseffekts verwende …

2
Ist die Markov-Ketten-basierte Probenahme die „beste“ für die Monte-Carlo-Probenahme? Gibt es alternative Systeme?
Markov-Kette Monte Carlo ist eine auf Markov-Ketten basierende Methode, mit der wir Proben (in einer Monte-Carlo-Einstellung) aus nicht standardmäßigen Verteilungen erhalten können, aus denen wir keine Proben direkt ziehen können. Meine Frage ist, warum die Markov-Kette für die Monte-Carlo-Probenahme "auf dem neuesten Stand" ist. Eine alternative Frage könnte sein, ob …


1
Lösung zur Ausübung von 2.2a.16 von „Robuste Statistik: Der auf Einflussfunktionen basierende Ansatz“
Auf Seite 180 von Robust Statistics: Der auf Einflussfunktionen basierende Ansatz findet sich folgende Frage: 16: Zeigen Sie, dass für ortsinvariante Schätzer immer ε∗≤12ε∗≤12\varepsilon^*\leq\frac{1}{2} . Finden Sie die entsprechende Obergrenze für den Finite-Sample-Breakdown-Punktε∗nεn∗\varepsilon^*_n , sowohl für den Fall, dassnnnungerade odernnnist. Der zweite Teil (nach dem Punkt) ist eigentlich trivial (angesichts …


Durch die Nutzung unserer Website bestätigen Sie, dass Sie unsere Cookie-Richtlinie und Datenschutzrichtlinie gelesen und verstanden haben.
Licensed under cc by-sa 3.0 with attribution required.