Verwenden Sie dieses Tag für jede * themenbezogene * Frage, bei der (a) "R" entweder als kritischer Teil der Frage oder als erwartete Antwort enthält, und (b) nicht * nur * die Verwendung von "R" betrifft.
Die folgende Frage baut auf der Diskussion auf dieser Seite auf . Bei einer gegebenen Antwortvariablen y, einer kontinuierlichen erklärenden Variablen xund einem Faktor facist es möglich, ein allgemeines additives Modell (GAM) mit einer Interaktion zwischen xund unter facVerwendung des Arguments zu definieren by=. Gemäß der Hilfedatei ?gam.models im R-Paket …
Es fällt mir schwer, bei der Validierung meines Modells auf die gleiche Seite wie mein Vorgesetzter zu gelangen. Ich habe die Rückstände analysiert (anhand der angepassten Werte beobachtet) und dies als Argument verwendet, um die von meinem Modell erzielten Ergebnisse zu diskutieren. Mein Vorgesetzter besteht jedoch darauf, dass die einzige …
Ich habe einige Modelle mit festen Effekten und wiederholten Messungen mit einer verschachtelten Fehlerkomponente geschätzt, die auf Gruppierungsvariablen basieren, dh nicht verschachtelten Modellen, die plm verwenden . Ich bin jetzt interessiert daran Testen Sie, ob die vollständigen Modelle signifikant unterschiedlich sind, dh wobei das vollständige Modell für und das vollständige …
Ich habe einen Datensatz mit 5.818.446 Zeilen und 51 Spalten, von denen 50 Prädiktoren sind. Meine Antwort ist quantitativ, daher interessiere ich mich für ein Regressionsmodell. Ich versuche, mithilfe des Caret-Pakets einen zufälligen Wald an meine Daten anzupassen. Ich habe jedoch nicht genug RAM, um dies zu tun. Ich habe …
Ich sehe mir an, wie sich der erwartete minimale euklidische Abstand zwischen zufällig einheitlichen Punkten und dem Ursprung ändert, wenn wir die Dichte zufälliger Punkte ( Punkte pro Quadrateinheit ) um den Ursprung erhöhen . Ich habe es geschafft, eine Beziehung zwischen den beiden als solche zu finden: Expected Min …
Ich habe einen Datensatz mit 338 Prädiktoren und 570 Instanzen (kann leider nicht hochgeladen werden), auf denen ich das Lasso verwende, um die Funktionsauswahl durchzuführen. Insbesondere verwende ich die cv.glmnetFunktion glmnetwie folgt: Dabei mydata_matrixhandelt es sich um eine 570 x 339-Binärmatrix und die Ausgabe ist auch binär: library(glmnet) x_dat <- …
Wir können eine lineare Regression ohne Zufälligkeit simulieren, was bedeutet, dass wir y=Xβy=Xβy=X\beta anstelle von y=Xβ+ϵy=Xβ+ϵy=X\beta+\epsilon . Wenn wir dann ein lineares Modell anpassen, sind die Koeffizienten identisch mit der "Grundwahrheit". Hier ist ein Beispiel. set.seed(0) n <- 1e5 p <- 3 X <- matrix(rnorm(n*p), ncol=p) beta <- runif(p) # …
Betrachten Sie ANOVA mit wiederholten AMessungen (RM-ANOVA) mit einem Faktor innerhalb des Subjekts und mehreren Messungen pro Subjekt für jede Stufe von A. Es ist eng verwandt mit der Zwei-Wege-ANOVA mit zwei Faktoren: Aund subject. Sie verwenden identische Zersetzung der Summe der Quadrate in vier Teile: A, subject, A⋅subject, und …
Ich habe einen eindimensionalen Datensatz und verwende die boxplotFunktion, um ein Box-Diagramm zu erstellen. Dann kann ich sehen, dass ich einige Ausreißer habe. Zählen die Ausreißer, wenn die Quantile bestimmt werden? Gibt es einen richtigen / falschen Weg oder sind beide Wege richtig, solange klar ist, welche Methode angewendet wurde? …
Ich wollte das Konfidenzintervall für die Standardabweichung für einige Daten schätzen. Der R-Code sieht wie folgt aus: library(boot) sd_boot <- function (x, ind) { res <- sd(x$ReadyChange[ind], na.rm = TRUE) return(res) } data_boot <- boot::boot(data, statistic = sd_boot, R = 10000) plot(data_boot) Und ich habe die nächste Handlung: Ich kann …
Ich führte Lasso durch und ließ dann eine einmalige Kreuzvalidierung aus cv<-cv.glmnet(df, df$Price, nfolds = 1500) Wenn ich einen Lebenslauf zeichne, erhalte ich Folgendes: Mir ist auch aufgefallen, dass ich 2 verschiedene Lambdas bekomme: lambda.minundlambda.1se Was ist der Unterschied zwischen diesen Lambdas? Was kann ich aus der obigen Darstellung im …
Ich habe Langzeitsammeldaten und möchte testen, ob die Anzahl der gesammelten Tiere von Wettereffekten beeinflusst wird. Mein Modell sieht wie folgt aus: glmer(SumOfCatch ~ I(pc.act.1^2) +I(pc.act.2^2) + I(pc.may.1^2) + I(pc.may.2^2) + SampSize + as.factor(samp.prog) + (1|year/month), control=glmerControl(optimizer="bobyqa", optCtrl=list(maxfun=1e9,npt=5)), family="poisson", data=a2) Erklärung der verwendeten Variablen: SumOfCatch: Anzahl der gesammelten Tiere pc.act.1, …
Ich versuche festzustellen, ob Raupen, die sich natürlich ernähren (Affenblume), resistenter gegen Raubtiere (Ameisen) sind als Raupen, die sich künstlich ernähren (eine Mischung aus Weizenkeimen und Vitaminen). Ich habe eine Versuchsstudie mit einer kleinen Stichprobengröße (20 Raupen; 10 pro Diät) durchgeführt. Ich habe jede Raupe vor dem Experiment gewogen. Ich …
Betrachten Sie die folgende binomiale Regression: # Create some data set.seed(10) n <- 500 x <- runif(n,0,100) y <- x + rnorm(n,sd=100) < 0 # Fit a binomial regression model model <- glm(y ~ x, family="binomial") summary(model) Die summaryFunktion gibt einen p-Wert von zurück 1.03e-05. Bei Verwendung anova.glmerhält man etwas …
Ich kann diese Grafik nicht interpretieren. Meine abhängige Variable ist die Gesamtzahl der Kinokarten, die für eine Show verkauft werden. Die unabhängigen Variablen sind die Anzahl der Tage vor der Show, Dummy-Variablen für die Saisonalität (Wochentag, Monat des Jahres, Feiertag), Preis, bis zum Datum verkaufte Tickets, Filmbewertung, Filmtyp (Thriller, Komödie …
We use cookies and other tracking technologies to improve your browsing experience on our website,
to show you personalized content and targeted ads, to analyze our website traffic,
and to understand where our visitors are coming from.
By continuing, you consent to our use of cookies and other tracking technologies and
affirm you're at least 16 years old or have consent from a parent or guardian.