Unten sehen Sie ein Streudiagramm (maximal 10.000 US-Dollar), das die durchschnittliche Spende darstellt, die ein Projekt erhält, und die Wortzahl des Aufsatzes über die Finanzierungsanfrage für alle Projekte, die in den offenen Spenderauswahldaten dargestellt sind . Es gibt ein auffälliges Muster, das ich durch Anpassen der Kurve zu charakterisieren versuchte …
Angesichts des modernen Zustands der Technologien und Werkzeuge für maschinelles Lernen (z. B. TensorFlow, Theano usw.) scheint die Einstiegsschwelle in letzter Zeit gesunken zu sein, und es reicht aus, beispielsweise auf Python programmieren zu können, um interessante Dinge zu erstellen. Eine weitere Quelle, die diesen Punkt unterstützt, ist die Spezialisierung …
Gibt es im Bereich der Statistik Konsens darüber, dass ein Buch die absolut beste Quelle ist und alle Aspekte des GLM vollständig abdeckt - von der Schätzung bis zur Schlussfolgerung - alles detailliert?
Mein Ökonometrieprofessor verwendete im Unterricht den Begriff "identifiziert". Wir betrachten der Form wobei eine Zufallsvariable und ein zufälliger Fehlerterm ist. Unsere Regressionslinien haben die FormY=β0+β1X+UY=β0+β1X+UY = \beta_0 + \beta_1 X + UXXXUUUY=β0^+β1^XY=β0^+β1^XY = \hat{\beta_0}+\hat{\beta_1}X Er gab die folgende Definition von "identifiziert": β0β0\beta_0 , werden identifiziert, wenn ein Datensatz genügend Informationen …
Ich versuche, zwei scheinbar gegensätzliche Aussagen über die Robustheit gegenüber der Nichtnormalität der Pearson-Korrelationsteststatistik in Einklang zu bringen (wobei Null "keine Korrelation" bedeutet). Diese CV-Antwort lautet: Sehr nicht robust. Dieses Biostat-Handbuch sagt: [...] zahlreiche Simulationsstudien haben gezeigt, dass lineare Regression und Korrelation nicht empfindlich auf Nichtnormalität reagieren; Eine oder beide …
Immerhin berechnen wir das VIF mit 1 / ( 1 -R.2j)1/(1−Rj2)1/(1-R_j^2). Ein VIF von555 entspricht einem R.2J.RJ2R_J^2 von 0,80.80.8. Für mich sind die Informationen vonR.2jRj2R_j^2wird nur dunkler, wenn ich die VIF-Formel anwende. Warum kann ich nicht einfach verwendenR.2jRj2R_j^2 Multikollinearität zu erkennen?
Diese Frage ergibt sich aus der Diskussion nach einer vorherigen Frage: Welche Verbindung besteht zwischen partiellen kleinsten Quadraten, reduzierter Rangregression und Hauptkomponentenregression? Für die Hauptkomponentenanalyse ist ein häufig verwendetes Wahrscheinlichkeitsmodell wobei , \ mathbf {w} \ in S ^ {p-1} , \ lambda> 0 und \ boldsymbol \ epsilon \ …
Ich frage mich, wie ich Daten und Vertrauensellipsen um einen bivariaten Median berechnen kann. Zum Beispiel kann ich leicht eine Datenellipse oder eine Konfidenzellipse für den bivariaten Mittelwert der folgenden Daten berechnen (hier nur eine Datenellipse). library("car") set.seed(1) df <- data.frame(x = rnorm(200, mean = 4, sd = 1.5), y …
Nach meinem Verständnis misst Cooks Abstand den Einfluss jeder Beobachtung, indem Punkte bei der Anpassung eines Modells ausgeschlossen werden. Ich gehe also davon aus, dass dies ein vernünftiger Ansatz für die Erkennung von Ausreißern sein könnte. Meine Fragen, vorausgesetzt, die Daten sind in Gruppen eingeteilt. Ist es möglich, Cooks Entfernung …
Um ein Kalibrierungsdiagramm für Überlebenswahrscheinlichkeiten zu erstellen, die anhand eines Cox-Modells geschätzt wurden, kann das geschätzte Risiko in Gruppen unterteilt, das durchschnittliche Risiko innerhalb einer Gruppe berechnet und dann mit der Kaplan-Meier-Schätzung verglichen werden. Was sind alternative Ansätze, für die kein Binning erforderlich ist? Welche spezifischen Schritte sind erforderlich, um …
Ich versuche, ein Überlebensmodell mit dem Weibull-Ansatz zu erstellen, aber die Falte ist, dass ich zeitlich variierende Kovariaten habe. Ich verwende das Überlebenspaket in R. Mein Anruf lautet: output <- survreg(Surv(start, stop, fail) ~ gdppc + [...] + cluster(name), data = mydata, dist="weibull") was den folgenden Fehler ergibt: Error in …
Angenommen, ich habe eine Website mit stündlichem Basisverkehr. Ich schalte auch zeitweise Fernsehwerbung, was meinen Webverkehr steigert. Ich möchte feststellen, welchen Einfluss meine Fernsehwerbung auf die Steigerung des Webverkehrs hat. Wenn ich ein ARMAX-Modell mit stündlichen TV-Werbeausgaben oder Impressionen als exogenen Variablen anpasse, kann dann behauptet werden, dass die AR-Begriffe …
Ich habe einen Datensatz mit einer kleinen Anzahl von Stichproben und einer großen Anzahl von Variablen. Ich habe für jede Variable einen Hypothesentest (T-Test) durchgeführt und eine Reihe von p-Werten erhalten. Die Variablen sind jedoch miteinander korreliert und die FDR-Korrektur (Benjamini-Hochberg-Verfahren) geht davon aus, dass die Tests unabhängig oder positiv …
We use cookies and other tracking technologies to improve your browsing experience on our website,
to show you personalized content and targeted ads, to analyze our website traffic,
and to understand where our visitors are coming from.
By continuing, you consent to our use of cookies and other tracking technologies and
affirm you're at least 16 years old or have consent from a parent or guardian.