Bei der Berechnung von Regressionsmodellen mit R verwende ich regelmäßig die Relevel-Funktion, damit mein Modell auch für die andere Ebene Ergebnisse liefert. Mir ist aufgefallen, dass dies manchmal, aber nicht oft, das Modell dahingehend veränderte, dass die Werte anderer Faktoren, die vor der Relevanz signifikant waren, nicht mehr vorhanden sind. Ist dies relevant oder außergewöhnlich und möglicherweise auf ein Problem mit meinen Daten zurückzuführen? Zeigt es, dass meine Daten wahrscheinlich nicht eine der Voraussetzungen für lineare Modelle erfüllen?
Ist es in diesem Zusammenhang in Ordnung, wenn ich relevel verwende, mein Modell neu berechne und dann Signifikanzwerte von beiden Modellen in meinem Artikel berichte? Wenn die Signifikanz zwischen den beiden Modellen für einen bestimmten Faktor unterschiedlich ist, sollte ich mich dann für eines entscheiden, das weniger optimistisch ist.
Ich nehme an, meine Frage verrät, dass ich nicht genug über lm weiß, um die Notwendigkeit eines Basislevels zu erfassen. Ich dachte, ich verstehe es ziemlich gut;) Irgendwie erklärte keine der Einführungen, die ich las, diesen Punkt, oder ich war zu dumm, um es zu verstehen. Wenn mich also jemand zu einer Site leiten könnte, an der der Punkt, an dem Basiswerte in lm vorliegen, erklärt wird, oder es selbst erklären könnte, wäre das auch großartig!
Bearbeiten: Hier ist ein minimales Beispiel:
library(datasets)
sprays<-OrchardSprays
model<-lm(decrease~treatment+rowpos+colpos,data=sprays)
summary(model)
Ein Teil der Zusammenfassung sagt
treatmentC 20.625 9.731 2.120 0.03866 *
Wenn also die Behandlung == C ist, hat dies einen signifikanten positiven Einfluss auf die Abnahme. Jetzt verlasse ich die 'Behandlung' auf B, um herauszufinden, welchen Einfluss die Behandlung hat == A:
sprays$treatment<-relevel(sprays$treatment,"B")
summary(model)
Und jetzt ist die Behandlung == C in diesem neuen Modell nicht signifikant:
treatmentC 17.625 9.731 1.811 0.07567 .
Entschuldigung für die Veröffentlichung am falschen Ort! Kann ich meine Frage in stats statexchange verschieben oder sollte ich dort eine neue öffnen?
d <- data.frame(y=runif(300),f=factor(rep(LETTERS[1:3],each=100)); lm(y~f,data=d)gibt Ihnen einen Anfang, obwohl es in diesem Fall natürlich keine signifikanten Änderungen geben wird (obwohl sich die Parameterschätzungen und p-Werte sicherlich ändern werden, wenn Sie neu einordnen).