Es gibt viele Situationen, in denen Sie möglicherweise mehrere verschiedene Klassifizierer trainieren oder verschiedene Methoden zum Extrahieren von Features verwenden. In der Literatur geben Autoren häufig den mittleren Klassifizierungsfehler über eine Reihe von zufälligen Teilungen der Daten an (dh nach einer doppelt verschachtelten Kreuzvalidierung) und geben manchmal auch Abweichungen über …
Ich habe eine Menge versteckter Markov-Modelle gelesen und konnte selbst eine ziemlich einfache Version davon programmieren. Aber es gibt zwei Möglichkeiten, die ich zu lernen scheine. Zum einen muss es gelesen und in Code implementiert werden (was getan wird), und zum anderen muss verstanden werden, wie es in verschiedenen Situationen …
Ich hatte immer den Eindruck, dass die Regression nur eine allgemeinere Form der ANOVA ist und die Ergebnisse identisch wären. In letzter Zeit habe ich jedoch sowohl eine Regression als auch eine ANOVA mit denselben Daten durchgeführt, und die Ergebnisse unterscheiden sich erheblich. Das heißt, im Regressionsmodell sind sowohl die …
Was bedeutet es zu sagen, dass "die Varianz ein verzerrter Schätzer ist"? Was bedeutet es, eine voreingenommene Schätzung durch eine einfache Formel in eine unvoreingenommene Schätzung umzuwandeln? Was genau macht diese Konvertierung? Was ist der praktische Nutzen dieser Konvertierung? Konvertieren Sie diese Werte, wenn Sie bestimmte Arten von Statistiken verwenden?
Wenn wir mit der Markov-Kette Monte Carlo arbeiten, um Rückschlüsse zu ziehen, brauchen wir eine Kette, die sich schnell mischt, dh die Unterstützung der hinteren Verteilung schnell durchwandert. Aber ich verstehe nicht, warum wir diese Eigenschaft brauchen, denn nach meinem Verständnis sollten und werden sich die akzeptierten Kandidatenzeichnungen auf den …
Ich werde Wikipedia erklären lassen, wie NPS berechnet wird: Der Net Promoter Score wird erhalten, indem Kunden auf einer Bewertungsskala von 0 bis 10 eine einzelne Frage gestellt werden, wobei 10 "äußerst wahrscheinlich" und 0 "überhaupt nicht wahrscheinlich" ist: "Wie wahrscheinlich ist es, dass Sie unser Unternehmen einem empfehlen würden …
Verschlossen . Diese Frage und ihre Antworten sind gesperrt, da die Frage nicht zum Thema gehört, aber von historischer Bedeutung ist. Derzeit werden keine neuen Antworten oder Interaktionen akzeptiert. Ich habe ein lineares Modell in R: erstellt mod = lm(train_y ~ train_x). Ich möchte ihm eine Liste von X übergeben …
Ich muss die inverse Matrix berechnen und habe die solveFunktion verwendet. Während es bei kleinen Matrizen gut funktioniert solve, ist es bei großen Matrizen tendenziell sehr langsam. Ich habe mich gefragt, ob es eine andere Funktion oder Kombination von Funktionen gibt (über SVD, QR, LU oder andere Zerlegungsfunktionen), die mir …
Konkret suche ich Referenzen (Papiere, Bücher), die den Fluch der Dimensionalität konsequent aufzeigen und erklären. Diese Frage stellte sich, nachdem ich dieses Whitepaper von Lafferty und Wasserman gelesen hatte . Im dritten Absatz erwähnen sie eine "bekannte" Gleichung, die impliziert, dass die beste Konvergenzrate ; Wenn jemand darauf eingehen kann …
Ich habe mich gefragt, ob es möglich ist, einen sehr starken Korrelationskoeffizienten (z. B. 0,9 oder höher) mit einem hohen p-Wert (z. B. 0,25 oder höher) zu haben. Hier ist ein Beispiel für einen niedrigen Korrelationskoeffizienten mit einem hohen p-Wert: set.seed(10) y <- rnorm(100) x <- rnorm(100)+.1*y cor.test(x,y) cor = …
Ich möchte ein binäres logistisches Regressionsmodell im Kontext von Streaming-Daten (mehrdimensionale Zeitreihen) verwenden, um den Wert der abhängigen Variablen der Daten (dh der Zeile), die gerade angekommen sind, unter Berücksichtigung der bisherigen Beobachtungen vorherzusagen. Soweit mir bekannt ist, wird die logistische Regression traditionell für die postmortale Analyse verwendet, bei der …
Fast jedes Entscheidungsbaum-Beispiel, auf das ich gestoßen bin, ist zufällig ein Binärbaum. Ist das so ziemlich universell? Unterstützen die meisten Standardalgorithmen (C4.5, CART usw.) nur binäre Bäume? Soweit ich weiß, ist CHAID nicht auf binäre Bäume beschränkt, aber das scheint eine Ausnahme zu sein. Eine Zwei-Wege-Trennung, gefolgt von einer weiteren …
Ich kämpfe darum, das Konzept der Verzerrung im Kontext der linearen Regressionsanalyse zu verstehen. Was ist die mathematische Definition von Voreingenommenheit? Was genau ist voreingenommen und warum / wie? Bildhaftes Beispiel?
Ich rüste eine tägliche Zeitreihe mit einem ARIMA-Modell aus. Die Daten werden täglich vom 01.02.2010 bis zum 30.07.2011 erhoben und beziehen sich auf den Zeitungsverkauf. Da ein wöchentliches Verkaufsmuster festgestellt werden kann (die tägliche durchschnittliche Anzahl der verkauften Exemplare ist normalerweise von Montag bis Freitag gleich und steigt dann am …
Angenommen, . Ich interessiere mich für die Randverteilung der diagonalen Elemente . Es gibt ein paar einfache Ergebnisse zur Verteilung von Submatrizen von (zumindest einige, die bei Wikipedia gelistet sind). Daraus kann ich schließen, dass die Randverteilung eines einzelnen Elements auf der Diagonale inverses Gamma ist. Aber ich konnte die …
We use cookies and other tracking technologies to improve your browsing experience on our website,
to show you personalized content and targeted ads, to analyze our website traffic,
and to understand where our visitors are coming from.
By continuing, you consent to our use of cookies and other tracking technologies and
affirm you're at least 16 years old or have consent from a parent or guardian.