Verwenden Sie dieses Tag für jede * themenbezogene * Frage, bei der (a) "R" entweder als kritischer Teil der Frage oder als erwartete Antwort enthält, und (b) nicht * nur * die Verwendung von "R" betrifft.
Da der Standardfehler einer linearen Regression normalerweise für die Antwortvariable angegeben wird, frage ich mich, wie Konfidenzintervalle in die andere Richtung erhalten werden können - z. B. für einen x-Achsenabschnitt. Ich kann mir vorstellen, was es sein könnte, aber ich bin sicher, dass es einen einfachen Weg geben muss, dies …
Kann mir jemand sagen, warum ich durch Rgewichtete kleinste Quadrate und manuelle Lösung durch Matrixoperation unterschiedliche Ergebnisse erhalte ? Insbesondere versuche ich, manuell zu lösen , wobei die Diagonalmatrix für Gewichte ist, die Datenmatrix ist, die Antwort ist Vektor. WAx=WbWAx=Wb\mathbf W \mathbf A\mathbf x=\mathbf W \mathbf bWW\mathbf WAA\mathbf Abb\mathbf b …
Meine Frage kurz: Gibt es Methoden zur Verbesserung der Laufzeit von R MICE (Datenimputation)? Ich arbeite mit einem Datensatz (30 Variablen, 1,3 Millionen Zeilen), der (ziemlich zufällig) fehlende Daten enthält. Etwa 8% der Beobachtungen in etwa 15 von 30 Variablen enthalten NAs. Um die fehlenden Daten zu unterstellen, führe ich …
Wie ordne ich neueren Beobachtungen in R mehr Gewicht zu? Ich nehme dies als häufig gestellte Frage oder Wunsch an, aber es fällt mir schwer, genau herauszufinden, wie ich dies umsetzen soll. Ich habe versucht, viel danach zu suchen, aber ich kann kein gutes praktisches Beispiel finden. In meinem Beispiel …
Wenn ich R für einige Daten verwende und versuche festzustellen, ob meine Daten heteroskedastisch sind oder nicht, habe ich zwei Implementierungen des Breusch-Pagan-Tests gefunden, bptest (Paket lmtest) und ncvTest (Paketauto). Diese führen jedoch zu unterschiedlichen Ergebnissen. Was ist der Unterschied zwischen den beiden? Wann sollten Sie sich für das eine …
Ich hoffe, jemand kann bei einer meiner Meinung nach relativ einfachen Frage helfen, und ich glaube, ich kenne die Antwort, aber ohne Bestätigung ist sie zu etwas geworden, dessen ich mir einfach nicht sicher sein kann. Ich habe einige Zähldaten als Antwortvariable und möchte messen, wie sich diese Variable mit …
Ich versuche, verschiedene Datensätze mit unbeaufsichtigten Algorithmen (Clustering) zu gruppieren. Das Problem ist, dass ich viele Funktionen (~ 500) und eine kleine Anzahl von Fällen (200-300) habe. Bisher habe ich nur Klassifizierungsprobleme gemacht, für die ich Daten immer als Trainingssätze gekennzeichnet hatte. Dort habe ich ein Kriterium (dh random.forest.importance oder …
Problem Ich möchte auf ein System schließen, das analog dazu ist, mit einer unbekannten Anzahl von Seiten zu sterben. Der Würfel wird mehrmals gewürfelt, wonach ich eine Wahrscheinlichkeitsverteilung über einen Parameter ableiten möchte, der der Anzahl der Seiten des Würfels entspricht, θ. Intuition Wenn Sie nach 40 Rollen 10 Rot-, …
Ich habe monatliche Daten von 1993 bis 2015 und möchte diese Daten prognostizieren. Ich habe das tsoutliers-Paket verwendet, um die Ausreißer zu erkennen, aber ich weiß nicht, wie ich mit meinen Daten weiter prognostizieren soll. Das ist mein Code: product.outlier<-tso(product,types=c("AO","LS","TC")) plot(product.outlier) Dies ist meine Ausgabe vom tsoutliers-Paket ARIMA(0,1,0)(0,0,1)[12] Coefficients: sma1 …
Ich verwende lmer in R, um die Auswirkung von condition ( cond) auf ein Ergebnis zu überprüfen . Hier sind einige aus Daten, wobei s der Objektidentifizierer und a, bund csind Bedingungen. library("tidyr") library("dplyr") set.seed(123) temp <- data.frame(s = paste0("S", 1:30), a = rnorm(30, -2, 1), b = rnorm(30, -3, …
Ich bin mir nicht ganz sicher, was genau VectorSource und VCorpus im 'tm'-Paket enthalten. Die Dokumentation dazu ist unklar. Kann mich jemand in einfachen Worten verstehen lassen?
Die R-Funktion cv.glm (Bibliothek: Boot) berechnet den geschätzten K-fachen Kreuzvalidierungs-Vorhersagefehler für verallgemeinerte lineare Modelle und gibt Delta zurück. Ist es sinnvoll, diese Funktion für eine Lasso-Regression (Bibliothek: glmnet) zu verwenden, und wenn ja, wie kann sie ausgeführt werden? Die glmnet-Bibliothek verwendet eine Kreuzvalidierung, um den besten Drehparameter zu erhalten, aber …
Wie soll ich das anovaErgebnis beim Vergleich zweier Modelle verstehen ? Beispiel: Res.Df RSS Df Sum of Sq F Pr(>F) 1 9 54.032 2 7 4.632 2 49.4 37.329 0.0001844 *** In der Manpage heißt es: "Berechnen Sie die Analyse von Varianz- (oder Abweichungs-) Tabellen für ein oder mehrere angepasste …
We use cookies and other tracking technologies to improve your browsing experience on our website,
to show you personalized content and targeted ads, to analyze our website traffic,
and to understand where our visitors are coming from.
By continuing, you consent to our use of cookies and other tracking technologies and
affirm you're at least 16 years old or have consent from a parent or guardian.