Der Theil-Sen-Schätzer ist für mich von Interesse, aber wenn ich ihn selbst implementiere, erhalte ich etwas, das als O (n ^ 2) skaliert. Laut Wikipedia kann es genau in O (n log (n)) berechnet werden. Kann mich jemand auf eine effiziente Implementierung hinweisen (Python oder Mathematica wären am besten, Matlab …
Beide Antworten in diesen Threads, eins und zwei, behaupten, dass transformiert werden sollte, bevor eine andere Transformation auf die Prädiktoren angewendet wird. In der Tat konzentriert sich das Weisberg- Kapitel über Transformationen mehr auf DV als auf Prädiktoren, ebenso wie die Handbuchseite des R-Car-Pakets powerTransform ().Y.YY Wir wissen jedoch, dass …
Der Datenerzeugungsprozess ist:y=sin(x+I(d=0))+sin(x+4∗I(d=1))+I(d=0)z2+3I(d=1)z2+N(0,1)y=sin(x+I(d=0))+sin(x+4∗I(d=1))+I(d=0)z2+3I(d=1)z2+N(0,1)y = \text{sin}\Big(x+I(d=0)\Big) + \text{sin}\Big(x+4*I(d=1)\Big) + I(d=0)z^2 + 3I(d=1)z^2 + \mathbb{N}\left(0,1\right) Sei eine Folge von bis der Länge 100 und d der entsprechende Faktor d \ in \ {0,1 \} . Nehmen Sie alle möglichen Kombinationen von x, z, d , um y zu berechnen : - 4 …
Stellen Sie sich eine Ergebnisvariable vor, die vier klare, geordnete Kategorien enthält. Dies scheint eine gute Verwendung der ordinalen logistischen Regression zu sein, um die Quotenverhältnisse für die Auswirkung von Kovariaten auf die Bewegung eines Subjekts um einen "Schritt" die Leiter hinauf zu schätzen. Da die Themen jedoch besonders gleichmäßig …
Die allgemeine Version: Ich muss schätzen, wobei und stetig und multivariat sind. Ich mache es lieber nichtparametrisch, weil ich keine gute funktionale Form im Sinn habe und so etwas wie unvoreingenommen sein muss. Ich wollte einen bedingten Kernel-Dichteschätzer verwenden, aber mir wurde klar, dass ich zuerst quantisieren musste . Dann …
Ich eine logistische Regression mit unabhängigen Variablen und Beobachtungen durch. Ich bewerte die Modellanpassung, um festzustellen, ob die Daten den Modellannahmen entsprechen, und habe mit dem Paket das folgende gruppierte Restdiagramm erstellt:242424123,996123,996123,996arm R Offensichtlich gibt es einige schlechte Anzeichen in dieser Darstellung: Viele Punkte liegen außerhalb der Konfidenzbänder und die …
Wie kann man objektiv ("algorithmisch" gelesen) ein geeignetes Modell für eine einfache lineare Regression der kleinsten Quadrate mit zwei Variablen auswählen? Angenommen, die Daten scheinen einen quadratischen Trend zu zeigen, und es wird eine Parabel generiert, die recht gut zu den Daten passt. Wie rechtfertigen wir es, dies zur Regression …
Für die Regressionsanalyse ist es häufig hilfreich, den Datengenerierungsprozess zu kennen, um zu überprüfen, wie die verwendete Methode funktioniert. Während es für eine einfache lineare Regression ziemlich einfach ist, dies zu tun, ist dies nicht der Fall, wenn die abhängige Variable einer bestimmten Verteilung folgen muss. Betrachten Sie eine einfache …
Dies ist eine recht allgemeine Frage: Angenommen, ich möchte ein Modell erstellen, um die nächste Beobachtung basierend auf den vorherigen Beobachtungen vorherzusagen ( kann ein Parameter zur experimentellen Optimierung sein). Wir haben also im Grunde ein Schiebefenster mit Eingabemerkmalen, um die nächste Beobachtung vorherzusagen.N.NNNNNN Ich kann einen Hidden-Markov-Modell-Ansatz verwenden, dh …
R in Action (Kabacoff, 2011) schlägt die folgende Routine vor, um die Überdispersion in einer logistischen Regression zu testen: Passen Sie die logistische Regression mithilfe der Binomialverteilung an: model_binom <- glm(Species=="versicolor" ~ Sepal.Width, family=binomial(), data=iris) Anpassung der logistischen Regression mithilfe der Quasibinomverteilung: model_overdispersed <- glm(Species=="versicolor" ~ Sepal.Width, family=quasibinomial(), data=iris) Verwenden …
Das Gesetz von Beer aus der Chemie besagt, dass die Absorption einer Flüssigkeit proportional zur Konzentration C ist , also: A = k C Der Standard besteht darin, einen Satz von Lösungen mit bekannten Konzentrationen herzustellen und die Absorption zu messen, um einen Standard zu bilden Kurve '(im Grunde eine …
Für mein aktuelles Projekt muss ich möglicherweise ein Modell erstellen, um das Verhalten einer bestimmten Personengruppe vorherzusagen. Der Trainingsdatensatz enthält nur 6 Variablen (ID dient nur zu Identifikationszwecken): id, age, income, gender, job category, monthly spend in dem monthly spendist die Antwortvariable. Der Trainingsdatensatz enthält jedoch ungefähr 3 Millionen Zeilen, …
Ich habe einen Datensatz, für den ich versuche, eine Regression durchzuführen, und der fehlschlägt. Die Situation: Tausende von Kampfroboterbetreibern kämpfen mit Kampfrobotern untereinander. Einige Kampfroboter sind stark und mächtig, andere sind schwach; Die Starken gewinnen öfter und verursachen mehr Schaden. Die Fähigkeiten der Roboterbediener variieren, wobei die erfahreneren häufiger gewinnen …
Gibt es überhaupt eine Möglichkeit, LASSO mit negativer Binomialregression auf R durchzuführen? Ich führe eine negative binomiale Regression für meinen Datensatz durch, da die Daten zu verteilt sind, um eine Poisson-Regression zu erzwingen. Inzwischen stehe ich auch vor einem Multikollinearitätsproblem. Ich habe bereits versucht, glmnetmit zu arbeiten family = poisson, …
We use cookies and other tracking technologies to improve your browsing experience on our website,
to show you personalized content and targeted ads, to analyze our website traffic,
and to understand where our visitors are coming from.
By continuing, you consent to our use of cookies and other tracking technologies and
affirm you're at least 16 years old or have consent from a parent or guardian.