Ich habe gelernt, dass eine Überanpassung erkannt werden kann, indem der Trainingsfehler und der Testfehler gegen die Epochen aufgetragen werden. Wie in: Ich habe diesen Blogpost gelesen, in dem sie sagen, dass das neuronale Netzwerk net5 überpasst und sie diese Zahl liefern: Was für mich seltsam ist, da der Validierungs- …
Die Unterscheidung zwischen streng zufälligen Variablen (die als solche modelliert werden sollten) und nicht zufälligen Variablen, von denen einige argumentieren, dass sie als zufällig modelliert werden könnten, wenn es sich um ein hierarchisches / mehrstufiges Modell handelt, ist für mich verschwommen. Bates und Bolker veranschaulichen zufällige Effekte mit Fällen echter …
Stimmt es, dass eine Normalitätsprüfung nur für kontinuierliche Daten (Verhältnis, Intervallniveau der Messung) und nicht für kategoriale Daten (nominal, ordinal) verwendet werden sollte? Gibt es eine Möglichkeit, die Normalität kategorialer Daten zu überprüfen?
Was ist der Unterschied zwischen "Goldstandard" und "Grundwahrheit"? Die beiden Wiki-Artikel (dh Goldstandard und Grundwahrheit ) beziehen beide Konzepte in Bezug auf Modellgenauigkeit / -genauigkeit miteinander in Beziehung. Das ist eine Möglichkeit. Ich habe aber auch festgestellt, dass diese Konzepte synonym verwendet werden, wenn es um beschriftete Datensätze geht: In …
Die Daten: Für die Zwecke dieser Frage / Kommunikation können wir annehmen, dass die Daten wie rnbinom(1000,size=0.1,prob=0.01)in R aussehen , das aus einer negativen Binomialverteilung (mit size=0.1und Wahrscheinlichkeit des Erfolgs prob=0.01) eine Zufallsstichprobe von 1.000 Beobachtungen generiert . Dies ist die Parametrisierung, bei der die Zufallsvariable die Anzahl der Fehler …
Ich habe einige Probleme, gleichwertige Ergebnisse zwischen einem aovModell zwischen wiederholten Messungen und einem lmergemischten Modell zu erhalten. Meine Daten und mein Skript sehen wie folgt aus data=read.csv("https://www.dropbox.com/s/zgle45tpyv5t781/fitness.csv?dl=1") data$id=factor(data$id) data id FITNESS TEST PULSE 1 1 pilates CYCLING 91 2 2 pilates CYCLING 82 3 3 pilates CYCLING 65 4 …
Ich habe eine Verteilung von Proben mit einer kleinen Anzahl von Werten in jeder (weniger als ). Ich habe den Median für jede Stichprobe berechnet, den ich mit einem Modell vergleichen und die Differenz zwischen dem Modell und dem Median jeder Stichprobe ermitteln möchte. Um ein konsistentes Ergebnis zu erzielen, …
Ich möchte Inzidenzraten berechnen, die entlang der Gefährdungsquoten dargestellt werden, um sowohl relative als auch absolute Risikomessgrößen darzustellen. Ich habe in anderen Studien gesehen, dass solche Inzidenzraten unter Verwendung von Poisson-Modellen mit Nachbeobachtungszeit im Modell als Offset berechnet werden können. Also habe ich das in R wie folgt versucht: library(survival) …
Ich habe eine methodische Frage und daher ist kein Beispieldatensatz beigefügt. Ich plane eine an den Neigungsscore angepasste Cox-Regression, mit der untersucht werden soll, ob ein bestimmtes Medikament das Risiko eines Ergebnisses verringert. Die Studie ist eine Beobachtungsstudie mit 10.000 Personen. Der Datensatz enthält 60 Variablen. Ich schätze, dass 25 …
Sollte ich zufällige Effekte in ein Modell aufnehmen, auch wenn sie statistisch nicht signifikant sind? Ich habe ein experimentelles Design mit wiederholten Messungen, bei dem jeder Einzelne drei verschiedene Behandlungen in zufälliger Reihenfolge erfährt. Ich möchte die Auswirkungen von Individuum und Ordnung kontrollieren, aber keines scheint in meinen Modellen statistisch …
Ich habe eine Reihe von Datenpunkten, die auf einem Ort sitzen und einem Muster folgen sollen, aber es gibt einige Streupunkte vom Hauptort, die in meiner endgültigen Analyse Unsicherheit verursachen. Ich möchte einen ordentlichen Ort erhalten, um ihn später für meine Analyse anzuwenden. Die blauen Punkte sind mehr oder weniger …
rpartSoweit ich weiß, hilft das Argument cp für die Funktion dabei, den Baum auf die gleiche Weise wie die Argumente minsplit oder minbucket vorab zu bereinigen. Was ich nicht verstehe, ist, wie CP-Werte berechnet werden. Zum Beispiel df<-data.frame(x=c(1,2,3,3,3,4), y=as.factor(c(TRUE, TRUE, FALSE, TRUE, FALSE, FALSE)), method="class") mytree<-rpart(y ~ x, data = …
Angenommen, Sie möchten ein lineares Modell schätzen: ( Beobachtungen der Antwort und Prädiktoren) nnnp+1p+1p+1E ( yich) = β0+ ∑j = 1pβjxi jE.(yich)=β0+∑j=1pβjxichj\mathbb{E}(y_i) = \beta_0 + \sum_{j=1}^p \beta_j x_{ij} Eine Möglichkeit, dies zu tun, ist die OLS-Lösung, dh wählen Sie die Koeffizienten so, dass die Summe der quadratischen Fehler minimal ist: …
Ich versuche, den Inflationsgrad zu quantifizieren (dh wie die beobachteten Datenpunkte am besten zu den Erwartungen passen). Eine Möglichkeit ist, sich das QQ-Diagramm anzusehen. Aber ich möchte einen numerischen Indikator für die Inflation berechnen - bedeutet, wie gut das Beobachtete zur theoretischen Gleichverteilung passt. Beispieldaten: # random uniform distribution pvalue …
We use cookies and other tracking technologies to improve your browsing experience on our website,
to show you personalized content and targeted ads, to analyze our website traffic,
and to understand where our visitors are coming from.
By continuing, you consent to our use of cookies and other tracking technologies and
affirm you're at least 16 years old or have consent from a parent or guardian.