Ich versuche zu verstehen, wie Random Forest funktioniert. Ich habe ein Gespür dafür, wie Bäume gebaut werden, kann aber nicht verstehen, wie Random Forest Vorhersagen aus Sackproben macht. Kann mir bitte jemand eine einfache Erklärung geben? :)
Ich verwende R Lavaan-Paket , um ein Strukturgleichungsmodell zu schätzen. Angenommen, das Modell besteht aus 1 endogenen Manifestvariablen mit 1 latenten und 2 manifest erklärenden Variablen: group = {0,1} attitude1 = latent,scale age = respondent's age Das gewünschte Lavamodell ist dann (funktioniert nicht): model <- ' attitude1 =~ att1 + …
Ich habe einen longitudinalen Datensatz von Personen und einige von ihnen wurden einer Behandlung unterzogen und andere nicht. Alle Personen sind von der Geburt bis zum 18. Lebensjahr in der Stichprobe und die Behandlung erfolgt in einem Alter zwischen diesem Bereich. Das Alter der Behandlung kann von Fall zu Fall …
Ist die Standardisierung einer abhängigen Variablen innerhalb der identifizierenden Gruppe sinnvoll? Das folgende Arbeitspapier (Verlangsamung der Entwaldung im legalen Amazonasgebiet; Preise oder Richtlinien ?, pdf ) verwendet eine standardisierte abhängige Variable, um die Auswirkungen der allgemeinen Richtlinienänderung in Brasilien auf die Entwaldung zu analysieren. Die Standardisierung erfolgt wie folgt: Y.n …
Ich mache eine Regression mit Random Forests, um Preise basierend auf mehreren Attributen vorherzusagen. Code wird in Python mit Scikit-learn geschrieben. Wie entscheiden Sie, ob Sie Ihre Variablen mit exp/ transformieren sollen, logbevor Sie sie für das Regressionsmodell verwenden? Ist es notwendig, einen Ensemble-Ansatz wie Random Forest zu verwenden?
Bearbeiten Ich habe ein Dokument gefunden , das genau das beschreibt, was ich brauche. Der einzige Unterschied besteht darin, dass das Papier die Monatsmittelwerte in Tagesdaten interpoliert, während die Monatsmittelwerte beibehalten werden. Ich habe Probleme, den Ansatz zu implementieren R. Hinweise sind willkommen. Original Für jede Woche liegen mir folgende …
Ich habe PCA mit 25 Variablen ausgeführt und die 7 besten PCs mit ausgewählt prcomp. prc <- prcomp(pollutions, center=T, scale=T, retx=T) Ich habe dann Varimax-Rotation an diesen Komponenten durchgeführt. varimax7 <- varimax(prc$rotation[,1:7]) Und jetzt möchte ich die PCA-gedrehten Daten mit Varimax drehen (da sie nicht Teil des Varimax-Objekts sind - …
Ich hoffe, dass diese Frage nicht als "zu allgemein" markiert wird, und hoffe, dass eine Diskussion in Gang kommt, von der alle profitieren. In der Statistik verbringen wir viel Zeit mit dem Erlernen großer Stichprobentheorien. Wir sind sehr daran interessiert, die asymptotischen Eigenschaften unserer Schätzer zu bewerten, einschließlich der Frage, …
Wenn in Standard-OLS-Regressionen zwei Annahmen verletzt werden (Normalverteilung von Fehlern, Homoskedastizität), sind Bootstrapping-Standardfehler und Konfidenzintervalle eine geeignete Alternative, um zu aussagekräftigen Ergebnissen hinsichtlich der Signifikanz von Regressorkoeffizienten zu gelangen? Funktionieren Signifikanztests mit Bootstrap-Standardfehlern und Konfidenzintervallen immer noch mit Heteroskedastizität? Wenn ja, welche Konfidenzintervalle können in diesem Szenario verwendet werden (Perzentil, …
Der Merriam-Webster - Wörterbuch definiert ein bedingtes Ereignis oder eine Situation als 1 : likely but not certain to happen : possible 2 : not logically necessary; especially : empirical 3 a : happening by chance or unforeseen causes b : subject to chance or unseen effects : unpredictable c …
Ich bin neu in der Datenwissenschaft und habe ein Problem beim Finden von Clustern in einem Datensatz mit 200.000 Zeilen und 50 Spalten in R. Da die Daten sowohl numerische als auch nominale Variablen enthalten, erscheinen Methoden wie K-means, die das euklidische Distanzmaß verwenden, nicht als geeignete Wahl. Ich wende …
Ziemlich grundlegende Frage: Was bedeutet eine Normalverteilung von Residuen aus einer linearen Regression? Wie wirkt sich dies auf meine ursprünglichen Daten aus der Regression aus? Ich bin total ratlos, danke Jungs
Ist es in Ordnung, einem Histogramm eine vertikale Linie hinzuzufügen, um den Mittelwert zu visualisieren? Es scheint mir in Ordnung zu sein, aber ich habe das noch nie in Lehrbüchern und Ähnlichem gesehen, also frage ich mich, ob es eine Art Konvention gibt, das nicht zu tun? Die Grafik ist …
Stellen Sie sich vor, es gibt 80 Völkerballspieler auf der Welt. Jeder von ihnen hat Tausende von Völkerballspielen mit den anderen 79 Spielern in mehr oder weniger zufälliger Reihenfolge gespielt. Dies ist eine Welt ohne Teams (z. B. hat jeder Spieler die Chance, in jedem Team eines der Spiele eingezogen …
We use cookies and other tracking technologies to improve your browsing experience on our website,
to show you personalized content and targeted ads, to analyze our website traffic,
and to understand where our visitors are coming from.
By continuing, you consent to our use of cookies and other tracking technologies and
affirm you're at least 16 years old or have consent from a parent or guardian.