Verwenden Sie dieses Tag für jede * themenbezogene * Frage, bei der (a) "R" entweder als kritischer Teil der Frage oder als erwartete Antwort enthält, und (b) nicht * nur * die Verwendung von "R" betrifft.
Was ist der Unterschied zwischen Normalisieren der Variablen und Durchführen von PCA; Verwenden der scale=TRUEOption (ohne Normalisierung der Variablen) in der prcompFunktion in R?
Ich habe ein schrittweise abgeleitetes binäres logistisches Regressionsmodell. Ich habe die calibrate(, bw=200, bw=TRUE)Funktion im rmsPaket in R verwendet, um die zukünftige Kalibrierung abzuschätzen. Die Ausgabe ist unten angegeben und zeigt die durch die Bootstrap-Überanpassung korrigierte Kalibrierungskurvenschätzung für das logistische Rückwärts-Abwärtsmodell. Ich bin mir jedoch nicht sicher, wie ich es …
Dies scheint ein häufiges Problem zu sein, aber ich kann keine Lösung finden. Ich habe eine Reihe von binären Beobachtungen und zwei verschiedene Modelle, jedes mit Vorhersagen für jede Beobachtung. Ich möchte die Kalibrierung der Modelle vergleichen. Es gibt verschiedene Ansätze zum Vergleichen der Unterscheidung dieser Modelle (dh siehe den …
Ich schätze das Modell E.( Y.| X.) = P.r ( Y.= 1 | X.) =α0+ ( 1 -α0- -α1) ϕ (X.'β) ,E(Y|X)=Pr(Y=1|X)=α0+(1−α0−α1)ϕ(X′β),E(Y|X) = Pr(Y=1|X) = \alpha_0 + (1 - \alpha_0 - \alpha_1)\phi(X'\beta),Dabei sind und Parameter, ist ein Längenvektor von Parametern, ist eine Datenmatrix, die abhängige Variable ist eine Binärdatei und …
Ich habe eine einfache ANOVA in R durchgeführt und dann die folgenden TukeyHSD () -Vergleiche generiert: Ich habe eine ziemlich gute Vorstellung (glaube ich), was das alles bedeutet, außer dem 'p adj'. Wenn ich richtig liege: Der Unterschied in den Testergebnissen zwischen Junioren und Neulingen beträgt 4,86, wobei Junioren durchschnittlich …
Vielleicht hängt diese Frage von den angegebenen Daten ab, aber gibt es eine "bessere" Bootstrap-Methode als die anderen? Ich verwende einfach einen Datensatz mit einer Variablen (der aus den Unterschieden zwischen Fußballergebnissen (2 Mannschaften) in den letzten 15 Wochen besteht). Beachten Sie zunächst den richtigen Versatz dieser Daten. Ich denke, …
Abhängige Variable Ich habe einen abhängigen Wert im Bereich von [0,1]. Bedeutung 0 und 1, und alle Werte dazwischen sind enthalten. Daher ist dies ein proportionaler Wert, wie zum Beispiel der Prozentsatz des Landes, das ein Landwirt düngt. Modell Das Modell, auf das ich mich derzeit konzentriere, ist ein logistisches …
Ich habe viele Messungen für mehrere Personen, bin mir aber nicht sicher, wie ich diese Wiederholungsmessstruktur beim Ausführen eines zufälligen Waldmodells berücksichtigen soll. Gibt es eine Möglichkeit, die zugrunde liegende Datenstruktur von Längsschnittdaten mithilfe eines zufälligen Waldmodells zu berücksichtigen? Ist das überhaupt nötig? - es scheint mir, dass es sein …
Vergleichen wir also zwei Normalverteilungen Do this x times: runs <- 100000 a.samples <- rnorm(runs, mean = 5) b.samples <- rbeta(runs, mean = 0) mc.p.value <- sum(a.samples > b.samples)/runs Die mc.p.-Werte, die unter unser Alpha (0,05) geteilt durch x fallen, würden dann die Fehlerrate vom Typ 1 ergeben. Unser H0 …
Ich habe zwei Proben. Wenn man ihre Dichte betrachtet, erscheint eine symmetrisch und die andere aus einer rechtsseitigen Verteilung. Ich möchte testen, dass die beiden nicht die gleiche Schiefe haben (wobei Fragen der selektiven Folgerung hier ignoriert werden). Mein Plan ist es, ein Bootstrap-Replikat der beiden Stichproben zu erstellen, den …
Ich verwende das Causal Impact-Paket in R, um auf den kausalen Effekt einer Intervention in einige Daten zu schließen, die stark korreliert und saisonal sind. Insbesondere habe ich 17 Tage stündliche Daten erhalten, wobei die Intervention am Ende von Tag 13 erfolgt. Ich habe zwei Kontrolldatensätze, die von der Intervention …
Ich erhalte den Fehler "Neue Faktoren, die in den Trainingsdaten nicht vorhanden sind". Aber ich habe die Ebenen und Klassen für jede Spalte in der Entwicklung sowie die Testdaten überprüft und sie sind gleich. Eine plausible Erklärung?
Ich arbeite an einem Problem, bei dem ich mehrere Paare derzeit lebender Männer habe i, von denen jedes vor niGenerationen einen vermuteten väterlichen Vorfahren hat (basierend auf genealogischen Beweisen) und bei denen ich Informationen darüber habe, ob es eine Nichtübereinstimmung in ihrem Y-chromosomalen Genotyp gibt (ausschließlich väterlicherseits) vererbt,xi= 1 für …
Um herauszufinden, wie die LASSORegression funktioniert, habe ich einen kleinen Code geschrieben, der die LASSORegression durch Auswahl des besten Alpha-Parameters optimieren soll . Ich kann nicht herausfinden, warum die LASSORegression nach der Kreuzvalidierung so instabile Ergebnisse für den Alpha-Parameter liefert. Hier ist mein Python-Code: from sklearn.linear_model import Lasso from sklearn.cross_validation …
We use cookies and other tracking technologies to improve your browsing experience on our website,
to show you personalized content and targeted ads, to analyze our website traffic,
and to understand where our visitors are coming from.
By continuing, you consent to our use of cookies and other tracking technologies and
affirm you're at least 16 years old or have consent from a parent or guardian.