Viele Quellen datieren das klassische „Box - Plot“ Design John Tukey und seine „schematische Handlung“ von 1970. Das Design relativ statisch geblieben zu sein scheint seither mit Edward Tufte des abgespeckte Version des Box - Plot Fehlern zu fangen, während Geigenhandlungen - obwohl eine informativere Variante der Boxhandlung - sind …
Ich lese das Statistikbuch (Freeman, Pisani, Purves) und versuche, ein Beispiel zu reproduzieren, in dem eine Münze etwa 50 Mal geworfen wird, die Anzahl der Köpfe gezählt wird und dies etwa 1.000 Mal wiederholt wird. Zuerst habe ich die Anzahl der Würfe (Stichprobengröße) bei 1000 gehalten und die Wiederholungen erhöht. …
Aus dem Lehrbuch „ Forecasting: Principles and Practice“ von Rob J. Hyndman und George Athanasopoulos , insbesondere der Abschnitt zur Genauigkeitsmessung : Eine Prognosemethode, die den MAE minimiert, führt zu Prognosen des Medians, während die Minimierung des RMSE zu Prognosen des Mittelwerts führt Kann jemand intuitiv erklären, warum die Minimierung …
Regularisierung in der Regression (linear, logistisch ...) ist die beliebteste Methode, um Überanpassung zu reduzieren. Gibt es gute Alternativen zur Regularisierung, insbesondere für große Datenmengen (Millionen von Beobachtungen und Millionen von Merkmalen), wenn das Ziel Vorhersagegenauigkeit ist (keine Erklärung)?
Ich habe mich bemüht, das Konzept der negativen Abtastung im Kontext von word2vec zu verstehen. Ich bin nicht in der Lage, die Idee der [negativen] Probenahme zu verdauen. Zum Beispiel wird in Mikolovs Arbeiten die negative Stichprobenerwartung wie folgt formuliert Logσ( ⟨ W , c ⟩ ) + k ⋅ …
Aus der Wikipedia-Seite mit dem Titel Korrelation impliziert nicht Kausalität , Für zwei beliebige korrelierte Ereignisse, A und B, umfassen die verschiedenen möglichen Beziehungen: A verursacht B (direkte Ursache); B verursacht A (umgekehrte Ursache); A und B sind Konsequenzen einer gemeinsamen Ursache, verursachen sich aber nicht gegenseitig; A und B …
Ich habe die Vorstellung gehört, dass Jaynes behauptet, Frequentisten würden mit einem "impliziten Prior" operieren. Was ist oder sind diese impliziten Prioritäten? Bedeutet dies, dass frequentistische Modelle alle Sonderfälle von Bayes'schen Modellen sind, die darauf warten, gefunden zu werden?
Ich möchte die Hypothese testen, dass zwei Stichproben aus derselben Grundgesamtheit stammen, ohne Annahmen über die Verteilung der Stichproben oder der Grundgesamtheit zu treffen. Wie soll ich das machen? Aus Wikipedia ist mein Eindruck, dass der Mann Whitney U-Test geeignet sein sollte, aber er scheint in der Praxis nicht für …
Erstens gibt er Wahrscheinlichkeit von Ergebnissen. So liegen seine Vorhersagen für die US-Wahlen derzeit bei 82% Clinton gegenüber 18% Trump. Nun, auch wenn Trump gewinnt, woher weiß ich, dass er nicht nur 18% der Zeit hätte gewinnen sollen? Das andere Problem ist, dass sich seine Wahrscheinlichkeiten mit der Zeit ändern. …
Dies ist im Wesentlichen eine Replikation einer Frage, die ich bei math.se gefunden habe und die nicht die Antworten bekam, auf die ich gehofft hatte. Sei eine Folge von unabhängigen, identisch verteilten Zufallsvariablen mit und .{Xi}i∈N{Xi}i∈N\{ X_i \}_{i \in \mathbb{N}}E[Xi]=1E[Xi]=1\mathbb{E}[X_i] = 1V[Xi]=1V[Xi]=1\mathbb{V}[X_i] = 1 Betrachten Sie die Bewertung von limn→∞P(1n−−√∑i=1nXi≤n−−√)limn→∞P(1n∑i=1nXi≤n) …
Ich habe ein tiefes neuronales Netzwerkmodell und muss es auf meinem Datensatz trainieren, der aus ungefähr 100.000 Beispielen besteht. Meine Validierungsdaten enthalten ungefähr 1000 Beispiele. Da es einige Zeit dauert, um jedes Beispiel zu trainieren (ungefähr 0,5 Sekunden für jedes Beispiel) und um eine Überanpassung zu vermeiden, möchte ich ein …
Ich versuche, verschiedene RNN-Architekturen (Recurrent Neural Network) zu verstehen, die auf Zeitreihendaten angewendet werden sollen, und bin etwas verwirrt mit den verschiedenen Namen, die häufig bei der Beschreibung von RNNs verwendet werden. Ist die Struktur von Langzeitspeicher (LSTM) und Gated Recurrent Unit (GRU) im Wesentlichen ein RNN mit einer Rückkopplungsschleife?
Die kartesischen Koordinaten eines zufälligen Punktes seien st .x,yx,yx,y(x,y)∼U(−10,10)×U(−10,10)(x,y)∼U(−10,10)×U(−10,10)(x,y) \sim U(-10,10) \times U(-10,10) Somit ist der Radius, , nicht gleichmäßig verteilt , wie angedeutet durch ‚s pdf .ρ=x2+y2−−−−−−√ρ=x2+y2\rho = \sqrt{x^2 + y^2}ρρ\rho Trotzdem würde ich erwarten, dass nahezu einheitlich ist, ohne Artefakte aufgrund der 4 Reste an den Rändern:θ=arctanyxθ=arctanyx\theta = …
Ich versuche, einen Multi-Label-Klassifikator zu erstellen, um vorhandenen Dokumenten mithilfe von Scikit Themen zuzuweisen Ich bearbeite meine Dokumente, indem ich sie über TfidfVectorizerdie Etiketten durch die MultiLabelBinarizerund OneVsRestClassifiermit einerSGDClassifier als Schätzer erstellte. Beim Testen meines Klassifikators erhalte ich jedoch nur Punkte bis zu 0,29 , was nach meiner Lektüre für …
Entscheidungsstumpf ist ein Entscheidungsbaum mit nur einer Teilung. Es kann auch als stückweise Funktion geschrieben werden. Angenommen, ist ein Vektor und ist die erste Komponente von . Bei der Regressionseinstellung kann es sich um einen Entscheidungsstumpf handelnx 1 xxxxx1x1x_1xxx f( x ) = { 35x1≤ 2x1> 2f(x)={3x1≤25x1>2f(x)= \begin{cases} 3& x_1\leq …
We use cookies and other tracking technologies to improve your browsing experience on our website,
to show you personalized content and targeted ads, to analyze our website traffic,
and to understand where our visitors are coming from.
By continuing, you consent to our use of cookies and other tracking technologies and
affirm you're at least 16 years old or have consent from a parent or guardian.