Angenommen, ich möchte ein tiefes neuronales Netzwerk trainieren, um eine Klassifizierung oder Regression durchzuführen, aber ich möchte wissen, wie sicher die Vorhersage sein wird. Wie könnte ich das erreichen? Meine Idee ist es, die Kreuzentropie für jedes Trainingsdatum basierend auf seiner Vorhersageleistung in den darüber liegenden neuronalen Metern zu berechnen. …
Die Frage basiert auf dem Artikel mit dem Titel: Bildrekonstruktion in der diffusen optischen Tomographie unter Verwendung des gekoppelten Strahlungstransport-Diffusions-Modells Download-Link Die Autoren wenden EM-Algorithmus sparsity Regularisierung einer unbekannten Vektors die Pixel eines Bildes zu schätzen. Das Modell ist gegeben durchl1l1l_1μμ\mu y=Aμ+e(1)(1)y=Aμ+ey=A\mu + e \tag{1} Die Schätzung ist in Gleichung …
Es ist bekannt, dass die Unabhängigkeit von Zufallsvariablen eine Nullkorrelation impliziert, eine Nullkorrelation jedoch keine Unabhängigkeit implizieren muss. Ich bin auf viele mathematische Beispiele gestoßen, die die Abhängigkeit trotz Nullkorrelation demonstrieren. Gibt es Beispiele aus dem wirklichen Leben, die diese Tatsache unterstützen?
Ich verstehe, wie Faltung funktioniert, aber ich verstehe nicht, wie 1D-Faltungen auf 2D-Daten angewendet werden. In diesem Beispiel sehen Sie eine 2D-Faltung in 2D-Daten. Aber wie wäre es, wenn es eine 1D-Faltung wäre? Nur ein 1D-Kernel, der auf die gleiche Weise gleitet? Und wenn der Schritt 2 war? Vielen Dank!
Ich habe algebraische Klassifikatoren gelesen : einen generischen Ansatz für schnelle Kreuzvalidierung, Online-Training und paralleles Training und war von der Leistung der abgeleiteten Algorithmen begeistert. Es scheint jedoch, dass es jenseits von Naive Bayes (und GBMs) nicht viele Algorithmen gibt, die an das Framework angepasst sind. Gibt es andere Papiere, …
Wir alle wissen, dass Zufallszahlengeneratoren in Computern keine echten Zufallszahlen erzeugen, sondern Pseudozufallszahlen. Außerdem sind einige RNGs besser als andere, und einige sind besser implementiert als andere. Was sind einige Beispiele dafür, wann ein schlechtes RNG verwendet oder ein RNG schlecht implementiert und ausgenutzt wurde? Beispiele, die ich gefunden habe, …
Wie ordne ich neueren Beobachtungen in R mehr Gewicht zu? Ich nehme dies als häufig gestellte Frage oder Wunsch an, aber es fällt mir schwer, genau herauszufinden, wie ich dies umsetzen soll. Ich habe versucht, viel danach zu suchen, aber ich kann kein gutes praktisches Beispiel finden. In meinem Beispiel …
Das Problem ist: Leiten Sie den Gradienten in Bezug auf die Eingabeschicht für ein einzelnes neuronales Netzwerk mit versteckter Schicht ab, indem Sie Sigmoid für Eingabe -> versteckt, Softmax für versteckt -> Ausgabe mit einem Kreuzentropieverlust verwenden. Ich kann den größten Teil der Ableitung mit der Kettenregel durchstehen, bin mir …
In Zeitreihenmodellen wie ARMA-GARCH werden zur Auswahl einer geeigneten Verzögerung oder Reihenfolge des Modells verschiedene Informationskriterien wie AIC, BIC, SIC usw. verwendet. Meine Frage ist sehr einfach: Warum verwenden wir nicht angepasstes , um ein geeignetes Modell auszuwählen? Wir können ein Modell auswählen, das zu einem höheren Wert des angepassten …
Angenommen, wir haben die Datenmatrix , die mal- , und den Markierungsvektor , der mal-eins ist. Hier ist jede Zeile der Matrix eine Beobachtung, und jede Spalte entspricht einer Dimension / Variablen. ( annehmen )XX\mathbf{X}nnnpppYYYn > pnnnn>pn>pn>p Und was tun data space, variable space, observation space, model spacebedeuten? Ist der …
Wenn ich R für einige Daten verwende und versuche festzustellen, ob meine Daten heteroskedastisch sind oder nicht, habe ich zwei Implementierungen des Breusch-Pagan-Tests gefunden, bptest (Paket lmtest) und ncvTest (Paketauto). Diese führen jedoch zu unterschiedlichen Ergebnissen. Was ist der Unterschied zwischen den beiden? Wann sollten Sie sich für das eine …
Nach "Efficient Backprop" von LeCun et al. (1998) ist es empfehlenswert, alle Eingaben so zu normalisieren, dass sie um 0 zentriert sind und im Bereich der maximalen zweiten Ableitung liegen. So würden wir zum Beispiel [-0.5,0.5] für die "Tanh" -Funktion verwenden. Dies soll den Fortschritt der Rückausbreitung unterstützen, wenn der …
Wie finde ich einen analytischen Ausdruck im folgenden Problem?D ( n , l , L )D.(n,l,L.)D(n,l,L) Ich lasse zufällig "Balken" der Länge in ein Intervall . Die "Balken" können sich überlappen. Ich möchte die mittlere Gesamtlänge des Intervalls das von mindestens einem "Balken" belegt wird.nnnlll[ 0 , L ][0,L.]][0,L]D.D.D[ 0 …
Während ich gerne denke, dass ich das Konzept der Vorinformationen in der statistischen Analyse und Entscheidungsfindung von Bayes gut verstehe, habe ich oft Probleme, mich mit seiner Anwendung zu befassen. Ich denke an einige Situationen, die meine Kämpfe veranschaulichen, und ich habe das Gefühl, dass sie in den Bayes'schen statistischen …
Ich hoffe, jemand kann bei einer meiner Meinung nach relativ einfachen Frage helfen, und ich glaube, ich kenne die Antwort, aber ohne Bestätigung ist sie zu etwas geworden, dessen ich mir einfach nicht sicher sein kann. Ich habe einige Zähldaten als Antwortvariable und möchte messen, wie sich diese Variable mit …
We use cookies and other tracking technologies to improve your browsing experience on our website,
to show you personalized content and targeted ads, to analyze our website traffic,
and to understand where our visitors are coming from.
By continuing, you consent to our use of cookies and other tracking technologies and
affirm you're at least 16 years old or have consent from a parent or guardian.