Ich lese ein Beispiel aus dem Buch Maschinelles Lernen für Hacker . Ich werde zuerst auf das Beispiel eingehen und dann über meine Frage sprechen. Beispiel : Nimmt einen Datensatz für 10 Jahre mit 25 Aktienkursen. Läuft PCA auf den 25 Aktienkursen. Vergleicht die Hauptkomponente mit dem Dow Jones Index. …
Vor kurzem habe ich mich für das Modellstapeln als eine Form des Ensemble-Lernens interessiert. Insbesondere habe ich ein wenig mit einigen Spielzeugdatensätzen für Regressionsprobleme experimentiert. Grundsätzlich habe ich einzelne "Level 0" -Regressoren implementiert, die Ausgabevorhersagen jedes Regressors als neues Feature für einen "Meta-Regressor" als Eingabe gespeichert und diesen Meta-Regressor an …
In verschiedenen Quellen (siehe z. B. hier ) wird die folgende Formel für das Konfidenzintervall für den Median angegeben (insbesondere zum Zeichnen von Kerben auf Box-and-Whisker-Plots): 95 % C. ichm e d i a n= M e d i a n ± 1,57 × I.Q R.N.- -- -√95% CImedian=Median±1.57×IQRN 95\%\ …
Was bedeutet Notation (Punkt über Tilde) bedeutet, in dem Zusammenhang wie x ˙ ~ N ( 0 , 1 ) ?∼˙∼˙\dot\simx∼˙N(0,1)x∼˙N(0,1)x \mathrel{\dot\sim} \mathcal N(0,1) Es stellt sich heraus, dass es einfacher ist, den richtigen Satz zu finden: tex.SE erklärt, dass man tippen sollte, \mathrel{\dot\sim}anstatt nur \dot\simdas Abstandsproblem zu beheben - …
Wie kann ich p,d and qWerte im ARIMA(p,d,q)Modell erhalten, die von geschätzt werden auto.arima(mytimeseries)? arima_model <- auto.arima (mytimeseries, ic = 'bic') Wenn wir uns die Ausgabe von ansehen arima_model $ arma wir bekommen, [1] 1 0 0 0 1 2 0 Welche Bedeutung haben die Zahlen in der obigen Reihenfolge?
Ich mache eine Studie über den Gebrauch von Polydrogen. Ich habe einen Datensatz von 400 Drogenabhängigen, die jeweils die Drogen angegeben haben, die sie missbrauchen. Es gibt mehr als 10 Medikamente und daher große mögliche Kombinationen. Ich habe die meisten Drogen, die sie konsumieren, in binäre Variablen umkodiert (dh Heroin …
Ich habe ein ähnliches Problem wie die hier gestellte Frage: Wie misst man die Ungleichmäßigkeit einer Verteilung? Ich habe eine Reihe von Wahrscheinlichkeitsverteilungen über die Wochentage. Ich möchte messen, wie nahe jede Verteilung an (1 / 7,1 / 7, ..., 1/7) liegt. Im Moment verwende ich eine Antwort aus der …
Ich versuche, die Verwendung der logistischen Regression in 2x2- und Ix2-Kontingenztabellen zu verstehen. Verwenden Sie dies beispielsweise als Beispiel Was ist der Unterschied zwischen der Verwendung des Chi-Quadrat-Tests und der Verwendung der logistischen Regression? Was ist mit einer Tabelle mit mehreren nominalen Faktoren (Ix2-Tabelle) wie folgt: Es gibt eine ähnliche …
In diesem Artikel (frei verfügbar über PubMed Central) verwenden die Autoren eine negative binomiale Regression, um die Punktzahl auf einem 10-Punkte-Screening-Instrument mit einer Bewertung von 0 bis 40 zu modellieren. Bei diesem Verfahren werden Zähldaten vorausgesetzt, was hier eindeutig nicht der Fall ist. Ich würde gerne Ihre Meinung dazu erfahren, …
Klassifizierungsprobleme mit nichtlinearen Grenzen können nicht mit einem einfachen Perzeptron gelöst werden . Der folgende R-Code dient nur zur Veranschaulichung und basiert auf diesem Beispiel in Python. nonlin <- function(x, deriv = F) { if (deriv) x*(1-x) else 1/(1+exp(-x)) } X <- matrix(c(-3,1, -2,1, -1,1, 0,1, 1,1, 2,1, 3,1), ncol=2, …
Ich lese gerade über die t-SNE-Visualisierungstechnik und es wurde erwähnt, dass einer der Nachteile der Verwendung der Hauptkomponentenanalyse (PCA) zur Visualisierung hochdimensionaler Daten darin besteht, dass nur große paarweise Abstände zwischen den Punkten beibehalten werden. Bedeutungspunkte, die im hochdimensionalen Raum weit voneinander entfernt sind, würden auch im niedrigdimensionalen Unterraum weit …
Heute erklärte unser Professor in der Klasse, dass "eine Überanpassung mit linearen Klassifikatoren nicht möglich ist". Ich halte das für falsch, da selbst lineare Klassifizierer empfindlich auf Ausreißer im Trainingssatz reagieren können - zum Beispiel eine Support Vector Machine mit hartem Rand: Ein einzelner verrauschter Datenpunkt kann ändern, welche Hyperebene …
Angenommen, ich versuche, eine Wahrscheinlichkeitsfunktion, die exponentiell verteilt ist, neu zu parametrisieren. Wenn meine ursprüngliche Wahrscheinlichkeitsfunktion lautet: p(y∣θ)=θe−θyp(y∣θ)=θe−θy p(y \mid \theta) = \theta e^{-\theta y} und ich möchte es mit neu parametrisieren , da keine Zufallsvariable ist, sondern ein Parameter, reicht es aus, nur einstecken?ϕ=1θϕ=1θ\phi = \frac{1}{\theta}θθ\theta Was ich explizit …
Ein Small-World-Netzwerk ist eine Art mathematischer Graph, bei dem die meisten Knoten keine Nachbarn sind, die meisten Knoten jedoch durch eine kleine Anzahl von Sprüngen oder Schritten voneinander erreicht werden können. Insbesondere wird ein Small-World-Netzwerk als ein Netzwerk definiert, bei dem der typische Abstand L zwischen zwei zufällig ausgewählten Knoten …
We use cookies and other tracking technologies to improve your browsing experience on our website,
to show you personalized content and targeted ads, to analyze our website traffic,
and to understand where our visitors are coming from.
By continuing, you consent to our use of cookies and other tracking technologies and
affirm you're at least 16 years old or have consent from a parent or guardian.