Ich sehe oft Leute, die eine Dimension / ein Feature eines Datensatzes auf einen Mittelwert von Null setzen, indem sie den Mittelwert aus allen Elementen entfernen. Aber ich habe nie verstanden, warum das so ist? Was bewirkt dies als Vorverarbeitungsschritt? Verbessert es die Klassifizierungsleistung? Hilft es, etwas über den Datensatz …
Ich habe eine Frage / Verwirrung über stationäre Reihen, die für die Modellierung mit ARIMA (X) benötigt werden. Ich denke darüber mehr in Bezug auf die Schlussfolgerung (Wirkung einer Intervention) nach, möchte aber wissen, ob Prognose und Schlussfolgerung einen Unterschied in der Reaktion bewirken. Frage: Alle einleitenden Ressourcen, die ich …
Ich habe oft diskrete Datensätze als Liniendiagramme gesehen, aber mir ist aufgefallen, dass die Linie an einem Punkt zwischen den Messintervallen einen Wert ableitet, der für diskrete Datensätze bedeutungslos ist. Ist es deshalb so, dass die Verwendung von Liniendiagrammen für diskrete Daten falsch ist? Nehmen Sie als Beispiel zwei Zeitreihendatensätze, …
Ich bin wissenschaftlicher Mitarbeiter für ein Labor (ehrenamtlich). Ich und eine kleine Gruppe wurden mit der Datenanalyse für einen Datensatz aus einer großen Studie beauftragt. Leider wurden die Daten mit einer Art Online-App gesammelt und nicht so programmiert, dass die Daten in der am besten verwendbaren Form ausgegeben wurden. Die …
Hier wird die Fehlinterpretation der Annahme der Normalität in der linearen Regression diskutiert (die 'Normalität' bezieht sich eher auf das X und / oder Y als auf die Residuen), und das Poster fragt, ob es möglich ist, nicht normalverteiltes X und Y zu haben und haben noch normalverteilte Residuen. Meine …
Wir haben zwei Kohorten mit jeweils 1000 Proben. Wir messen 2 Mengen pro Kohorte. Die erste ist eine binäre Variable. Die zweite Zahl ist eine reelle Zahl, die einer starken Schwanzverteilung folgt. Wir möchten beurteilen, welche Kohorte für jede Metrik die beste Leistung erbringt. Es stehen zahlreiche statistische Tests zur …
Ich weiß, wie man PCA (Principal Component Analysis) durchführt, aber ich möchte Schritte kennen, die für die Faktoranalyse verwendet werden sollten. Betrachten wir zur Durchführung einer PCA eine Matrix , zum Beispiel:EINEINA 3 1 -1 2 4 0 4 -2 -5 11 22 20 Ich habe seine Korrelationsmatrix berechnet B …
Angenommen, wir haben IID-Zufallsvariablen mit der Verteilung . Wir werden eine Probe des beobachten ist auf folgende Weise: lassen unabhängig Zufallsvariablen an , dass die ganze 's und ‚s sind unabhängig und definieren die Stichprobengröße . Die - geben an, welche der - in der Stichprobe enthalten sind, und wir …
Ich versuche, die am besten geeignete charakteristische Verteilung von wiederholten Messdaten eines bestimmten Typs zu finden. In meinem Fachgebiet der Geologie verwenden wir häufig die radiometrische Datierung von Mineralien aus Proben (Gesteinsbrocken), um herauszufinden, wie lange es her ist, dass ein Ereignis stattgefunden hat (das Gestein hat sich unter eine …
Ich habe mich gefragt, wie Bootstrap-CIs (und insbesondere BCa) bei normal verteilten Daten funktionieren. Es scheint eine Menge Arbeit zu geben, um ihre Leistung bei verschiedenen Arten von Verteilungen zu untersuchen, aber bei normal verteilten Daten konnte nichts gefunden werden. Da es naheliegend erscheint, zuerst zu lernen, sind die Papiere …
Meine Daten werden hier beschrieben. Was kann dazu führen, dass beim Anpassen einer ANOVA mit wiederholten Messungen ein "Error () - Modell ist ein singulärer Fehler" auftritt? Ich versuche, den Effekt einer Interaktion zu sehen, indem lmerich folgenden Basisfall benutze : my_null.model <- lmer(value ~ Condition+Scenario+ (1|Player)+(1|Trial), data = my, …
Ich habe die vielen hervorragenden Diskussionen auf der Website über die Interpretation von Konfidenzintervallen und Vorhersageintervallen gelesen, aber ein Konzept ist immer noch etwas rätselhaft: Betrachten Sie das OLS-Framework und wir haben das angepasste Modell . Wir erhalten ein und werden gebeten, die Antwort vorherzusagen. Wir berechnen und geben als …
Ich habe einen sehr großen Datensatz und es fehlen ungefähr 5% zufällige Werte. Diese Variablen sind miteinander korreliert. Der folgende Beispiel-R-Datensatz ist nur ein Spielzeugbeispiel mit Dummy-korrelierten Daten. set.seed(123) # matrix of X variable xmat <- matrix(sample(-1:1, 2000000, replace = TRUE), ncol = 10000) colnames(xmat) <- paste ("M", 1:10000, sep …
Welchen kritischen p-Wert verwendet die step()Funktion in R für die schrittweise Regression? Ich nehme an, es ist 0,15, aber ist meine Annahme richtig? Wie kann ich den kritischen p-Wert ändern?
Wir untersuchen statistische Tests nach Bayes und stoßen auf ein merkwürdiges (zumindest für mich) Phänomen. Betrachten Sie den folgenden Fall: Wir sind daran interessiert zu messen, welche Population A oder B eine höhere Conversion-Rate aufweist. Für eine Plausibilitätsprüfung setzen wir pA=pBpA=pBp_A = p_B , dh die Konversionswahrscheinlichkeit ist in beiden …
We use cookies and other tracking technologies to improve your browsing experience on our website,
to show you personalized content and targeted ads, to analyze our website traffic,
and to understand where our visitors are coming from.
By continuing, you consent to our use of cookies and other tracking technologies and
affirm you're at least 16 years old or have consent from a parent or guardian.