Die Topologie des Google Inception-Modells finden Sie hier: Google Inception Netowrk Mir ist aufgefallen, dass dieses Modell 3 Softmax-Schichten enthält (Nr. 154, Nr. 152, Nr. 145), von denen 2 eine Art frühes Entkommen dieses Modells darstellen. Soweit ich weiß, ist die Softmax-Ebene für die endgültige Ausgabe vorgesehen. Warum gibt es …
In welchen Situationen sollten wir t-SNE verwenden (abgesehen von der Datenvisualisierung)? T-SNE wird zur Dimensionsreduzierung verwendet. Die Antwort auf diese Frage legt nahe, dass t-SNE nur zur Visualisierung und nicht zum Clustering verwendet werden sollte. Was nützt dann t-SNE?
In Bishops Mustererkennung und maschinellem Lernen las ich Folgendes, unmittelbar nachdem die Wahrscheinlichkeitsdichte eingeführt wurde:p(x∈(a,b))=∫bap(x)dxp(x∈(a,b))=∫abp(x)dxp(x\in(a,b))=\int_a^bp(x)\textrm{d}x Bei einer nichtlinearen Änderung der Variablen transformiert sich eine Wahrscheinlichkeitsdichte aufgrund des Jacobi-Faktors anders als eine einfache Funktion. Wenn wir zum Beispiel eine Änderung der Variablen , wird eine Funktion zu . Betrachten Sie nun …
Ich habe festgestellt, dass beim Erstellen zufälliger Waldregressionsmodelle, zumindest in R, der vorhergesagte Wert niemals den in den Trainingsdaten angezeigten Maximalwert der Zielvariablen überschreitet. Ein Beispiel finden Sie im folgenden Code. Ich erstelle ein Regressionsmodell, um mpgbasierend auf den mtcarsDaten Vorhersagen zu treffen . Ich baue OLS- und zufällige Waldmodelle …
Ich lese den Artikel Fehlerausbreitung nach der Monte-Carlo-Methode in geochemischen Berechnungen, Anderson (1976), und es gibt etwas, das ich nicht ganz verstehe. Betrachten Sie einige Messdaten und ein Programm , das sie verarbeitet und einen bestimmten Wert zurückgibt. In dem Artikel wird dieses Programm verwendet, um zuerst den besten Wert …
Ich werde den Kolmogorov-Smirnov-Test verwenden, um die Normalität von MYDATA in R zu testen. Dies ist ein Beispiel für meine Arbeit ks.test(MYDATA,"pnorm",mean(MYDATA),sd(MYDATA)) Hier ist das Ergebnis, das R mir gibt: data: MYDATA D = 0.13527, p-value = 0.1721 alternative hypothesis: two-sided Warning message: In ks.test(MYDATA, "pnorm", mean(MYDATA), sd(MYDATA)) : ties …
LASSO und adaptives LASSO sind zwei verschiedene Dinge, richtig? (Für mich sehen die Strafen anders aus, aber ich überprüfe nur, ob ich etwas verpasse.) Wenn Sie allgemein von elastischem Netz sprechen, ist der Sonderfall LASSO oder adaptives LASSO? Welches macht das glmnet-Paket, vorausgesetzt Sie wählen alpha = 1? Adaptive LASSO …
Ich möchte aus einer univariaten Dichte , aber nur die Beziehung:fXfXf_X fX(x)=∫fX|Y(x|y)fY(y)dy.fX(x)=∫fX|Y(x|y)fY(y)dy.f_X(x) = \int f_{X\vert Y}(x\vert y)f_Y(y) dy. Ich möchte die Verwendung von MCMC (direkt auf der Integraldarstellung) vermeiden, und da und leicht sind, habe ich mir überlegt, den folgenden Sampler zu verwenden ::fX|Y(x|y)fX|Y(x|y)f_{X\vert Y}(x\vert y)fY(y)fY(y)f_Y(y) Für .j=1,…,Nj=1,…,Nj=1,\dots, N Beispiel …
Ich war in dem Python über Regressions Metriken Lese Scikit-Learn Handbuch und obwohl jeder von ihnen seine eigenen Formel hat, kann ich nicht intuitiv sagen , was ist der Unterschied zwischen und Varianz - Score und daher , wenn der eine oder andere zu verwenden , um zu bewerten meine …
Es gibt mehrere zusammenfassende Statistiken. Wenn Sie die Streuung einer Verteilung beschreiben möchten, können Sie beispielsweise die Standardabweichung oder den Gini-Koeffizienten verwenden . Ich weiß, dass die Standardabweichung auf der zentralen Tendenz basiert, dh der Abweichung vom Mittelwert, und der Gini-Koeffizient eine allgemeine Messung der Dispersion. Ich weiß auch, dass …
Dies ist mein erster Versuch für jemanden aus dem Frequentistenlager, eine Bayes'sche Datenanalyse durchzuführen. Ich habe eine Reihe von Tutorials und einige Kapitel aus der Bayesian Data Analysis von A. Gelman gelesen. Als erstes mehr oder weniger unabhängiges Beispiel für die Datenanalyse habe ich die Wartezeiten für Züge ausgewählt. Ich …
Ich stoße auf den Würfelkoeffizienten für Volumenähnlichkeit ( https://en.wikipedia.org/wiki/S%C3%B8rensen%E2%80%93Dice_coefficient ) und Genauigkeit ( https://en.wikipedia.org/wiki/Accuracy_and_precision) ). Es scheint mir, dass diese beiden Maßnahmen gleich sind. Irgendwelche Gedanken?
Ich lerne gerade Randomisierungstests. Mir fallen zwei Fragen ein: Ja, es ist einfach und intuitiv, wie der p-Wert mit dem Randomisierungstest berechnet wird (was meiner Meinung nach mit dem Permutationstest identisch ist?). Wie können wir jedoch auch ein 95% -Konfidenzintervall erzeugen, wie wir es bei normalen parametrischen Tests tun? Während …
Beim Verstärkungslernen wird häufig eine lineare Funktionsnäherung verwendet, wenn große Zustandsräume vorhanden sind. (Wenn Nachschlagetabellen nicht mehr durchführbar sind.) Die Form des Wertes mit linearer Funktionsnäherung ist gegeben durchQ -Q−Q- Q ( s , a ) = w1f1( s , a ) + w2f2( s , a ) + ⋯ …
In einem klassischen Mediationsmodell sind die Pfade in der folgenden Abbildung dargestellt , in dem der erste Schritt des Testens der Vermittlungswirkung von M zwischen X und Y darin besteht, dass X signifikant mit Y korreliert (wie in Tafel A in der Figur gezeigt). Allerdings stieß ich in einer Situation …
We use cookies and other tracking technologies to improve your browsing experience on our website,
to show you personalized content and targeted ads, to analyze our website traffic,
and to understand where our visitors are coming from.
By continuing, you consent to our use of cookies and other tracking technologies and
affirm you're at least 16 years old or have consent from a parent or guardian.