Statistiken und Big Data

Fragen und Antworten für Personen, die sich für Statistik, maschinelles Lernen, Datenanalyse, Data Mining und Datenvisualisierung interessieren

2
Ist eine Protokolltransformation eine gültige Technik zum Testen nicht normaler Daten?
Bei der Durchsicht einer Arbeit gaben die Autoren an, "Kontinuierliche Ergebnisvariablen mit einer verzerrten Verteilung wurden unter Verwendung der natürlichen Logarithmen transformiert, bevor t-Tests durchgeführt wurden, um die vorausgesetzten Normalitätsannahmen zu erfüllen." Ist dies eine akzeptable Methode, um nicht normale Daten zu analysieren, insbesondere wenn die zugrunde liegende Verteilung nicht …


2
Wie kann man basierend auf früheren Ereignissen vorhersagen, wann das nächste Ereignis eintritt?
Ich bin ein Gymnasiast und arbeite an einem Computerprogrammierungsprojekt, aber ich habe nicht viel Erfahrung mit Statistik und Modellierung von Daten außerhalb eines High School Statistikkurses, daher bin ich ein bisschen verwirrt. Grundsätzlich habe ich eine ziemlich große Liste (vorausgesetzt, sie ist groß genug, um die Annahmen für statistische Tests …

3
Halbüberwachtes Lernen, aktives Lernen und tiefes Lernen für die Klassifizierung
Letzte Bearbeitung mit allen Ressourcen aktualisiert: Für ein Projekt wende ich Algorithmen für maschinelles Lernen zur Klassifizierung an. Herausforderung: Sehr begrenzte beschriftete Daten und viel mehr unbeschriftete Daten. Tore: Wenden Sie eine halbüberwachte Klassifizierung an Wenden Sie einen halbüberwachten Etikettierungsprozess an (bekannt als aktives Lernen). Ich habe viele Informationen aus …

5
2D-Analogon der Standardabweichung?
Betrachten Sie das folgende Experiment: Einer Gruppe von Menschen wird eine Liste von Städten gegeben und sie werden gebeten, die entsprechenden Orte auf einer (ansonsten nicht beschrifteten) Weltkarte zu markieren. Für jede Stadt erhalten Sie eine Streuung von Punkten, die ungefähr in der jeweiligen Stadt zentriert sind. Einige Städte, sagen …



4
Wie berechnet man das Konfidenzintervall des Mittelwerts?
Stellen Sie sich vor, Sie wiederholen ein Experiment dreimal. In jedem Experiment sammeln Sie dreifache Messungen. Die Triplikate sind im Vergleich zu den Unterschieden zwischen den drei experimentellen Mitteln eher eng beieinander. Die Berechnung des Mittelwerts ist ziemlich einfach. Aber wie kann man ein Konfidenzintervall für den Mittelwert berechnen? Beispieldaten: …


1
Wie sieht die Community den vierten Quadranten?
Nassim Taleb von Black Swan (oder Schande) hat das Konzept ausgearbeitet und das entwickelt, was er "eine Karte der Grenzen der Statistik" nennt . Sein grundlegendes Argument ist, dass es eine Art Entscheidungsproblem gibt, bei dem die Verwendung eines statistischen Modells schädlich ist. Dies wären Entscheidungsprobleme, bei denen die Konsequenz …


7
Mittelwert eines Schiebefensters in R
Ich habe einen Vektor von Werten, die ich den Durchschnitt in Fenstern entlang einer kleineren Folie angeben möchte. Zum Beispiel für einen Vektor mit den folgenden Werten: 4, 5, 7, 3, 9, 8 Eine Fenstergröße von 3 und eine Folie von 2 würden Folgendes bewirken: (4+5+7)/3 = 5.33 (7+3+9)/3 = …
19 r 

4
Wann sollte ich einen variablen Autoencoder anstelle eines Autoencoders verwenden?
Ich verstehe die Grundstruktur von variierendem Autoencoder und normalem (deterministischem) Autoencoder und die Mathematik dahinter, aber wann und warum würde ich eine Art von Autoencoder der anderen vorziehen? Alles, woran ich denken kann, ist die vorherige Verteilung latenter Variablen von variationalem Autoencoder, die es uns ermöglicht, die latenten Variablen abzutasten …

2
Warum muss aus der posterioren Verteilung eine Stichprobe gezogen werden, wenn wir die posterioren Verteilung bereits kennen?
Mein Verständnis ist, dass bei Verwendung eines Bayes'schen Ansatzes zur Schätzung von Parameterwerten: Die hintere Verteilung ist die Kombination der vorherigen Verteilung und der Wahrscheinlichkeitsverteilung. Wir simulieren dies, indem wir eine Stichprobe aus der posterioren Verteilung generieren (z. B. mit einem Metropolis-Hasting-Algorithmus, um Werte zu generieren, und akzeptieren sie, wenn …

6
Convolutional Layers: Auffüllen oder nicht auffüllen?
Die AlexNet-Architektur verwendet Null-Auffüllungen (siehe Abbildung). In diesem Artikel wird jedoch nicht erläutert, warum diese Auffüllung eingeführt wird. Der Standford CS 231n-Kurs lehrt, dass die räumliche Größe durch Auffüllen erhalten bleibt: Ich frage mich, ist es der einzige Grund, warum wir Polster brauchen? Ich meine, wenn ich die räumliche Größe …

Durch die Nutzung unserer Website bestätigen Sie, dass Sie unsere Cookie-Richtlinie und Datenschutzrichtlinie gelesen und verstanden haben.
Licensed under cc by-sa 3.0 with attribution required.