In Abschnitt 3.2 von Bishops Mustererkennung und maschinellem Lernen erörtert er die Bias-Varianz-Zerlegung und erklärt, dass für eine quadratische Verlustfunktion der erwartete Verlust in einen quadratischen Bias-Term zerlegt werden kann (der beschreibt, wie weit die durchschnittlichen Vorhersagen von den wahren abweichen Modell), ein Varianzterm (der die Streuung der Vorhersagen um …
Ich versuche, mich mit dem folgenden Beweis zu beschäftigen, dass der Gaußsche die maximale Entropie hat. Wie macht der markierte Schritt Sinn? Eine bestimmte Kovarianz korrigiert nur den zweiten Moment. Was passiert mit dem dritten, vierten, fünften Moment usw.?
Ich habe einen kleinen Datensatz von 14 verschiedenen Zeiten, um eine Aufgabe abzuschließen. Ich habe jedoch Schwierigkeiten, ein geeignetes Diagramm zu finden, um die Daten grafisch darzustellen. Wenn die Stichprobe größer wäre, würde ich einen Boxplot oder ein Histogramm verwenden, aber ich bin nicht sicher, ob es in diesem Fall …
Ich sehe an verschiedenen Stellen erwähnt, dass ANOVA seine Schätzung mit der Methode der Momente durchführt. Diese Behauptung verwirrt mich, denn obwohl ich mit der Methode der Momente nicht vertraut bin, verstehe ich, dass sie etwas anderes ist als die Methode der maximalen Wahrscheinlichkeit und nicht gleichwertig damit. Andererseits kann …
Ich verstehe nicht, wie diese Gleichung abgeleitet wurde. P(I|M1∩M2)≤P(I)P(I′)⋅P(M1|I)P(M2|I)P(M1|I′)P(M2|I′)P(I|M1∩M2)≤P(I)P(I′)⋅P(M1|I)P(M2|I)P(M1|ich′)P(M2|ich′)P(I|M_{1}\cap M_{2}) \leq \frac{P(I)}{P(I')}\cdot \frac{P(M_{1}|I)P(M_{2}|I)}{P(M_{1}|I')P(M_{2}|I')} Diese Gleichung stammt aus der Arbeit "Trial by Probability", in der der Fall von OJ Simpson als Beispielproblem angegeben wurde. Der Angeklagte wird wegen Doppelmordes vor Gericht gestellt und es werden zwei Beweise gegen ihn vorgelegt. ist …
In Statistical Methods in the Atmospheric Sciences stellt Daniel Wilks fest, dass multiple lineare Regression zu Problemen führen kann, wenn zwischen den Prädiktoren sehr starke Wechselbeziehungen bestehen (3. Auflage, Seite 559-560): Eine Pathologie, die bei der multiplen linearen Regression auftreten kann, besteht darin, dass ein Satz von Prädiktorvariablen mit starken …
Ich möchte ein dynamisches Modell implementieren, um einem Benutzer einen Film zu empfehlen. Die Empfehlung sollte jedes Mal aktualisiert werden, wenn der Benutzer einen Film ansieht oder bewertet. Um es einfach zu halten, denke ich daran, zwei Faktoren zu berücksichtigen: die vergangenen Bewertungen anderer Filme durch den Benutzer die Zeit, …
Ich habe letztes Wochenende Faraway's Lehrbuch Linearmodelle mit R (1. Auflage) gelesen . Faraway hatte ein Kapitel mit dem Titel "Statistische Strategie und Modellunsicherheit". Er beschrieb (Seite 158) , dass er künstlich einige Daten erzeugt ein sehr kompliziertes Modell, dann fragte er seine Studenten , die Daten zu modellieren und …
Ich habe einige Probleme beim Verstehen von Gewinnchancen und möchte nur eine grundlegende Erklärung für deren Interpretation. Ich habe verschiedene Posts gefunden, die sich auf Quoten beziehen, aber die meisten sind komplexer als das, was ich zu verstehen versuche. Hier ist ein Beispiel, wie ich Quoten interpretiere: Wenn die Quoten …
Wenn ich ein Würfelpaar unendlich oft würfle und immer den höheren Wert der beiden wähle, übersteigt der erwartete Mittelwert der höchsten Werte dann 3,5? Es scheint so, als müsste es sein, dass, wenn ich eine Million Würfel würfle und jedes Mal den höchsten Wert wähle, die Chancen überwältigend sind, dass …
Meine Frage bezieht sich auf eine in geoR:::.negloglik.GRFoder ausgenutzte Berechnungstechnik geoR:::solve.geoR. In einem linearen gemischten Modellaufbau gilt: Y=Xβ+Zb+eY=Xβ+Zb+e Y=X\beta+Zb+e wobei ββ\beta und bbb die festen bzw. zufälligen Effekte sind. Auch ist Σ=cov(Y)Σ=cov(Y)\Sigma=\text{cov}(Y) Bei der Abschätzung der Effekte muss berechnet werden, was normalerweise mit etwas wie , aber manchmal ist fast …
Ich arbeite an einem Projekt zur kollaborativen Filterung (CF), dh zur Vervollständigung einer teilweise beobachteten Matrix oder allgemeiner eines Tensors. Ich bin ein Neuling auf dem Gebiet, und für dieses Projekt muss ich schließlich unsere Methode mit anderen bekannten vergleichen, die heutzutage vorgeschlagenen Methoden mit ihnen vergleichen, nämlich dem Stand …
Kann mir bitte jemand sagen, wie ich ein neuronales Netzwerk mit der Batch-Methode aufbauen soll? Ich habe gelesen, dass wir im Batch-Modus für alle Stichproben im Trainingssatz den Fehler, das Delta und damit die Delta-Gewichte für jedes Neuron im Netzwerk berechnen und diese dann akkumulieren, anstatt sie sofort zu aktualisieren, …
We use cookies and other tracking technologies to improve your browsing experience on our website,
to show you personalized content and targeted ads, to analyze our website traffic,
and to understand where our visitors are coming from.
By continuing, you consent to our use of cookies and other tracking technologies and
affirm you're at least 16 years old or have consent from a parent or guardian.