Statistiken und Big Data

Fragen und Antworten für Personen, die sich für Statistik, maschinelles Lernen, Datenanalyse, Data Mining und Datenvisualisierung interessieren

4
Wie kann man die Nachteile von Hierarchical Clustering verstehen?
Kann jemand die Vor- und Nachteile von Hierarchical Clustering erklären? Hat hierarchisches Clustering die gleichen Nachteile wie K? Was sind die Vorteile von Hierarchical Clustering gegenüber K? Wann sollten wir K-Mittel anstelle von Hierarchical Clustering verwenden und umgekehrt? Antworten auf diesen Beitrag erklären die Nachteile von k sehr gut. Wie …



2
Ist Student's T-Test ein Wald-Test?
Ist Student's T-Test ein Wald-Test? Ich habe die Beschreibung der Wald-Tests aus Wassermans All of Statistics gelesen . Es scheint mir, dass der Wald-Test T-Tests umfasst. Ist das korrekt? Wenn nein, was macht einen T-Test nicht zu einem Wald-Test?

2
Extreme Lernmaschine: Worum geht es?
Ich habe mehr als ein Jahr lang über das Paradigma der extremen Lernmaschine (Extreme Learning Machine, ELM) nachgedacht, es implementiert und verwendet. Je länger ich es tue, desto mehr bezweifle ich, dass es wirklich eine gute Sache ist. Meine Meinung scheint jedoch im Gegensatz zur wissenschaftlichen Gemeinschaft zu stehen, wo …
19 regression 


1
Warum überhaupt ANOVA verwenden, anstatt direkt in Post-Hoc- oder geplante Vergleichstests einzusteigen?
Was bringt es Ihnen, wenn Sie einen solchen ANOVA-Test in einer Situation zwischen Gruppen durchführen? Was tun Sie als Erstes nach dem Hoc-Test (Bonferroni, Šidák usw.) oder bei geplanten Vergleichstests? Warum nicht den ANOVA-Schritt komplett überspringen? Ich stelle fest, dass in einer solchen Situation der einzige Vorteil von ANOVA zwischen …


1
Passgenauigkeit für 2D-Histogramme
Ich habe zwei Datensätze, die Sternparameter darstellen: einen beobachteten und einen modellierten. Mit diesen Sets erstelle ich ein sogenanntes Zwei-Farben-Diagramm (TCD). Ein Beispiel ist hier zu sehen: A sind die beobachteten Daten und B die aus dem Modell extrahierten Daten (egal, welche schwarzen Linien, welche Punkte die Daten darstellen). Ich …

2
Hypothesentest und Signifikanz für Zeitreihen
Ein gewöhnlicher Signifikanztest bei der Betrachtung von zwei Populationen ist der T-Test, wenn möglich der gepaarte T-Test. Dies setzt voraus, dass die Verteilung normal ist. Gibt es ähnliche vereinfachende Annahmen, die einen Signifikanztest für eine Zeitreihe ergeben? Insbesondere haben wir zwei relativ kleine Populationen von Mäusen, die unterschiedlich behandelt werden, …

2
Backpropagation-Algorithmus
Ich habe eine leichte Verwirrung über den Backpropagation- Algorithmus, der in Multilayer Perceptron (MLP) verwendet wird. Der Fehler wird durch die Kostenfunktion korrigiert. Bei der Backpropagation versuchen wir, das Gewicht der ausgeblendeten Ebenen anzupassen. Den Ausgabefehler kann ich nachvollziehen, also e = d - y[ohne die Indizes]. Die Fragen sind: …


1
Verlustfunktion für Autoencoder
Ich experimentiere ein bisschen mit Autoencodern und habe mit Tensorflow ein Modell erstellt, das versucht, den MNIST-Datensatz zu rekonstruieren. Mein Netzwerk ist sehr einfach: X, e1, e2, d1, Y, wobei e1 und e2 Codierschichten sind, d2 und Y Decodierschichten sind (und Y die rekonstruierte Ausgabe ist). X hat 784 Einheiten, …

1
Kalibrieren eines Boosted-Klassifikators für mehrere Klassen
Ich habe Alexandru Niculescu-Mizil und Rich Caruanas Artikel " Erhalten kalibrierter Wahrscheinlichkeiten durch Boosting " und die Diskussion in diesem Thread gelesen . Ich habe jedoch immer noch Probleme beim Verstehen und Implementieren der logistischen oder Plattschen Skalierung , um die Ausgabe meines Multi-Class-Boosting-Klassifikators zu kalibrieren (sanftes Boosten mit Entscheidungsstümpfen). …

3
Wie verwendet die logistische Regression die Binomialverteilung?
Ich versuche zu verstehen, wie die logistische Regression die Binomialverteilung verwendet. Angenommen, ich untersuche den Erfolg von Nestern bei Vögeln. Die Wahrscheinlichkeit, dass ein Nest erfolgreich ist, beträgt 0,6. Mit der Binomialverteilung kann ich die Wahrscheinlichkeit für r Erfolge bei n Versuchen berechnen (Anzahl der untersuchten Nester). Aber wie wird …

Durch die Nutzung unserer Website bestätigen Sie, dass Sie unsere Cookie-Richtlinie und Datenschutzrichtlinie gelesen und verstanden haben.
Licensed under cc by-sa 3.0 with attribution required.