Statistiken und Big Data

Fragen und Antworten für Personen, die sich für Statistik, maschinelles Lernen, Datenanalyse, Data Mining und Datenvisualisierung interessieren

2
QQ-Plot-Referenzlinie nicht 45 °
Ich habe (standardisierte) Rückgabedaten mit qqplot()in MATLAB gegen die theoretischen Quantile einer Normalverteilung aufgetragen. Die Linie im QQ-Plot hat jedoch keinen Winkel von 45 °, sondern ist ein wenig gedreht. Vielleicht verstehe ich das Konzept eines QQ-Diagramms falsch, aber soll es nicht genau eine 45 ° -Linie sein? Ich habe …
10 matlab  qq-plot 

1
Der beste Weg, um den LSTM-Status zu initialisieren
Ich habe mich gefragt, wie der Status für LSTMs am besten initialisiert werden kann. Momentan initialisiere ich es einfach auf alle Nullen. Ich kann online nichts darüber finden, wie man es initialisiert. Eine Sache, an die ich gedacht habe, ist, den Ausgangszustand zu einem trainierbaren Parameter zu machen. Irgendein Rat?




1
root-n konsistenter Schätzer, aber root-n konvergiert nicht?
Ich habe den Begriff "root-n" konsistenter Schätzer oft gehört. Aufgrund der Ressourcen, von denen ich angewiesen wurde, dachte ich, dass ein konsistenter "root-n" -Schätzer Folgendes bedeutet: Der Schätzer konvergiert auf den wahren Wert (daher das Wort "konsistent"). Der Schätzer konvergiert mit einer Rate von1/n−−√1/n1/\sqrt{n} Das verwirrt mich, da nicht konvergiert? …

1
Ist es in Ordnung, die Cross-Entropy-Loss-Funktion mit Soft Labels zu verwenden?
Ich habe ein Klassifizierungsproblem, bei dem Pixel eher mit weichen Beschriftungen (die Wahrscheinlichkeiten bezeichnen) als mit harten 0,1-Beschriftungen gekennzeichnet werden. Früher mit harter 0,1-Pixel-Markierung lieferte die Kreuzentropieverlustfunktion (sigmoidCross entropyLossLayer von Caffe) anständige Ergebnisse. Ist es in Ordnung, die Sigmoid-Kreuzentropie-Verlustschicht (von Caffe) für dieses Problem der weichen Klassifizierung zu verwenden?

3
Anzahl der Markov-Ketten-Monte-Carlo-Proben
Es gibt eine Menge Literatur über die Konvergenzdiagnostik der Markov-Kette Monte Carlo (MCMC), einschließlich der beliebtesten Gelman-Rubin-Diagnostik. Alle diese bewerten jedoch die Konvergenz der Markov-Kette und befassen sich damit mit der Frage des Einbrennens. Wie soll ich nach dem Burn-In entscheiden, wie viele MCMC-Proben ausreichen, um meinen Schätzprozess fortzusetzen? Die …

3
Hoher Rückruf - Geringe Präzision für unausgeglichenen Datensatz
Ich habe derzeit Probleme beim Analysieren eines Tweet-Datasets mit Support-Vektor-Maschinen. Das Problem ist, dass ich einen unausgeglichenen Binärklassen-Trainingssatz habe (5: 2); Dies wird voraussichtlich proportional zur tatsächlichen Klassenverteilung sein. Bei der Vorhersage erhalte ich eine geringe Genauigkeit (0,47) für die Minderheitsklasse im Validierungssatz. Rückruf ist 0,88. Ich habe versucht, mehrere …

3
Likelihood Ratio vs Wald Test
Nach dem, was ich gelesen habe, sind unter anderem auf der Website der UCLA-Statistikberatungsgruppe Likelihood-Ratio-Tests und Wald-Tests ziemlich ähnlich, wenn getestet wird, ob zwei glm-Modelle einen signifikanten Unterschied in der Passform für einen Datensatz aufweisen (entschuldigen Sie, wenn mein Wortlaut könnte ein bisschen aus sein). Im Wesentlichen kann ich zwei …


1
Johansen-Test auf Kointegration
Ich teste mit dem Johansen-Test auf Kointegration. Ich habe Fragen wie die Interpretation der Testergebnisse gesehen, aber wenn ich meine interpretiere, habe ich einige Zweifel. In meinen Ergebnissen r = 3seitdem 4.10 < 10.49kann ich also keine stationäre Serie bilden. Es ist dasselbe für r = 2 und r = …

2
Bootstrapping-Konfidenzintervall aus einer Regressionsvorhersage
Für die Hausaufgaben erhielt ich Daten, um einen Prädiktor zu erstellen / zu trainieren, der die Lasso-Regression verwendet. Ich erstelle den Prädiktor und trainiere ihn mit der Lasso-Python-Bibliothek von scikit learn. Jetzt habe ich diesen Prädiktor, der bei gegebener Eingabe die Ausgabe vorhersagen kann. Die zweite Frage lautete: "Erweitern Sie …


5
Wenn
Lassen und unabhängige Ereignisse, und sei und unabhängige Ereignisse sein. Wie zeige ich, dass und auch unabhängige Ereignisse sind?AAABBBAAACCCAAAB∪CB∪CB\cup C Nach der Definition unabhängiger Ereignisse sind und genau dann unabhängig, wennAAAB∪CB∪CB\cup CP(A∩(B∪C))=P(A)P(B∪C).P(A∩(B∪C))=P(A)P(B∪C).P(A\cap (B\cup C)) = P(A)P(B\cup C). Da und und und unabhängig sind, weiß ich, dass AAABBBAAACCCP(A∩B)=P(A)P(B)andP(A∩C)=P(A)P(C).P(A∩B)=P(A)P(B)andP(A∩C)=P(A)P(C).P(A\cap B) = P(A)P(B) …

Durch die Nutzung unserer Website bestätigen Sie, dass Sie unsere Cookie-Richtlinie und Datenschutzrichtlinie gelesen und verstanden haben.
Licensed under cc by-sa 3.0 with attribution required.