Statistiken und Big Data

Fragen und Antworten für Personen, die sich für Statistik, maschinelles Lernen, Datenanalyse, Data Mining und Datenvisualisierung interessieren


2
Was ist nach einer Statistik mit schlechter Anpassung für eine Bestätigungsfaktoranalyse zu tun?
Kontext Ich habe einige Probleme mit meiner Doktorarbeit. Meine Diplomarbeit befasst sich mit dem organisatorischen Bürgerschaftsverhalten von Sekundarschullehrern durch ihre Wahrnehmung der Organisationskultur und ihres organisatorischen Vertrauens. Ich habe eine Stichprobe von 871 Lehrern. Ich habe drei Instrumente, aber sie wurden von anderen Forschern entwickelt und in einigen anderen Studien …


1
Bayesian vs Maximum Entropie
Angenommen, die Menge, auf die wir schließen wollen, ist eine Wahrscheinlichkeitsverteilung. Wir wissen , ist alles , was die Verteilung von einem Satz kommt bestimmt, sagen, von einigen seiner Momente und wir haben ein vorrangiges .E.E.EQ.Q.Q Das Maximum-Entropie-Prinzip (MEP) besagt, dass das die geringste relative Entropie von (dh ) ist …

3
Mahalanobis-Abstand zwischen zwei bivariaten Verteilungen mit unterschiedlichen Kovarianzen
Die Frage ist so ziemlich im Titel enthalten. Was ist der Mahalanobis-Abstand für zwei Verteilungen verschiedener Kovarianzmatrizen? Was ich bisher gefunden habe, setzt für beide Distributionen die gleiche Kovarianz voraus, dh etwas in dieser Art: ΔTΣ−1ΔΔTΣ−1Δ\Delta^T \Sigma^{-1} \Delta Was ist, wenn ich zwei verschiedene ?ΣΣ\Sigma Hinweis: - Das Problem ist …

1
Verteilung der Stichprobenkorrelation
Angenommen, ich habe eine große Population von Datenpunkten und die Pearson-Korrelation ist(x,y)(x,y)(x,y) corr(X,Y)=ρcorr(X,Y)=ρ\textrm{corr}(X,Y) = \rho Was kann ich vernünftigerweise über die Korrelation sagen, die ich bei einer Stichprobe der Größe erwarten werde ? Wenn die Stichprobenkorrelation , wie ist ungefähr die Streuung ? Ist voreingenommen?nnnρsρs\rho_sρsρs\rho_sρsρs\rho_s Wenn wir einige Annahmen wie …



1
Bayesianische Inferenz für die multinomiale Verteilung mit asymmetrischem Vorwissen?
Angenommen, ich werde einige Proben aus einer Binomialverteilung erhalten. Eine Möglichkeit, meine Vorkenntnisse zu modellieren, ist eine Beta-Distribution mit den Parametern und . Soweit ich weiß, ist dies gleichbedeutend damit, in Versuchen "Köpfe" mal gesehen zu haben . Daher ist es eine gute Abkürzung, um die vollständige Bayes'sche Folgerung durchzuführen, …

1
Multiple Regression mit kleinen Datenmengen
Ich habe einen Datensatz mit Projektfallstudien für eine neue Art von Forschungsmethode für Regierungsbehörden zur Unterstützung von Entscheidungsaktivitäten. Meine Aufgabe ist es, eine Schätzmethode zu entwickeln, die auf früheren Erfahrungen für zukünftige Projekte zu Schätzzwecken basiert. Mein Datensatz ist auf 50 Fälle begrenzt. Ich habe mehr als 30 (potenzielle) Prädiktoren …

2
Kann man Cohens Kappa nur für zwei Urteile verwenden?
Ich benutze Cohens Kappa , um die Übereinstimmung zwischen zwei Richtern zu berechnen. Es wird berechnet als: P(A)−P(E)1−P(E)P(A)−P(E)1−P(E) \frac{P(A) - P(E)}{1 - P(E)} wobei der Anteil der Übereinstimmung und die Wahrscheinlichkeit einer zufälligen Übereinstimmung ist.P ( E )P(A)P(A)P(A)P(E)P(E)P(E) Für den folgenden Datensatz erhalte ich nun die erwarteten Ergebnisse: User A …

1
Was bedeutet "Fallkontrolle" und "Querschnitt" im Kontext der logistischen Modellierung?
Während des Studiums der logistischen Modellierung habe ich die folgende Aussage gelesen Die Tatsache, dass aus logistischen Modellen in Fallkontroll- oder Querschnittsstudien nur Quotenverhältnisse und keine individuellen Risiken geschätzt werden können, ist nicht überraschend. Ich weiß nicht, wofür die "Fallkontroll" - und "Querschnittsstudien" in der statistischen Analyse stehen. Darüber hinaus …

1
Kann mir jemand helfen zu verstehen, um welche Art von Problem es sich handelt? Ich bin mir nicht sicher, ob dies als Hypothesentest eingestuft wird
Bitte entschuldigen Sie, wenn diese Frage nicht klar ist. Ich bin mir nicht sicher, ob ich die richtigen Terminologien verwende. Ich habe mehrmals ein Experiment in verschiedenen Umgebungen durchgeführt. Meine Daten sehen also ungefähr so ​​aus: Environment1 1.2 2.1 1.1 1.5 1.6 Environment2 4.2 2.6 3.5 2.5 2.9 Environment3 7.2 …



Durch die Nutzung unserer Website bestätigen Sie, dass Sie unsere Cookie-Richtlinie und Datenschutzrichtlinie gelesen und verstanden haben.
Licensed under cc by-sa 3.0 with attribution required.