Statistiken und Big Data

Fragen und Antworten für Personen, die sich für Statistik, maschinelles Lernen, Datenanalyse, Data Mining und Datenvisualisierung interessieren


2
Erlauben Sie Daten, die Prioritäten zu diktieren, und führen Sie das Modell dann mit diesen Prioritäten aus? (z. B. datengesteuerte Prioritäten aus demselben Datensatz)
Nach meinem Verständnis sollten wir nicht zulassen, dass derselbe Datensatz, den wir analysieren, bestimmt / definiert, wie die vorherigen Verteilungen in einer Bayes'schen Analyse aussehen. Insbesondere ist es unangemessen, frühere Verteilungen für eine Bayes'sche Analyse basierend auf zusammenfassenden Statistiken aus demselben Datensatz zu definieren, an den Sie dann die Prioritäten …
9 bayesian  prior 

3
Bester Algorithmus zur Klassifizierung von Zeitreihenmotordaten
Ich arbeite an einem Maschinensteuerungsprojekt. Wir können den Motorstrom während des Betriebs messen. Beispieldaten von zwei Motoren, die eine Operation erfolgreich ausführen, sind unten aufgeführt. Die rote Kurve zeigt den Strom von einem Motor, die blaue Spur den Strom von einem anderen. Ich möchte versuchen, einen Algorithmus zur Identifizierung von …



6
Wie gruppieren / standardisieren Sie Variablen in R?
Gesperrt . Diese Frage und ihre Antworten sind gesperrt, da die Frage nicht zum Thema gehört, aber historische Bedeutung hat. Derzeit werden keine neuen Antworten oder Interaktionen akzeptiert. Zu den mir vertrauten Funktionen gehören Skalierung von Basis R und Neuskalierung von ARM. Vielleicht wäre der beste Weg, eine Variante von …

1
Wie interpretiere ich p-Werte von 0 oder 1?
Ich habe eine ANOVA durchgeführt, bei der zum Beispiel eine Interaktion zwischen Geschlecht und Klasse festgestellt wurde, als ich wissen möchte, in welchen Klassen sich Jungen und Mädchen unterscheiden, aber in vielen Fällen finde ich (angepasste) p-Werte von 0 und 1. Wie / warum ist das möglich? Scheint nicht richtig …
9 r 

3
Können zufällige Effekte nur für kategoriale Variablen gelten?
Diese Frage mag dumm klingen, aber ... ist es richtig, dass zufällige Effekte nur für kategoriale Variablen gelten können (wie individuelle ID, Populations-ID, ...), z. B. ist eine kategoriale Variable:xixix_i ~ β x iyiyiy_iβxiβxi\beta_{x_i} ~ N o r m ( μ , δ 2 )βxiβxi\beta_{x_i}Norm(μ,δ2)Norm(μ,δ2)Norm(\mu, \delta^2) aber nach dem Prinzip …

3
Wie kann ich Volkszählungsmikrodaten für kleine Gebiete mithilfe einer 1% igen Mikrodatenstichprobe im großen Maßstab simulieren und Statistiken im kleinen Gebiet aggregieren?
Ich möchte eine multivariate Analyse auf Einzelebene auf kleinen Ebenen der geografischen Aggregation (australische Volkszählungssammlungsbezirke) durchführen. Es ist klar, dass die Volkszählung auf diesen kleinen Aggregationsebenen aus Datenschutzgründen nicht verfügbar ist, daher untersuche ich andere Alternativen. Fast alle interessierenden Variablen sind kategorisch. Ich habe zwei Datensätze zur Verfügung: Die 1% …

2
Verständnis der ANOVA-Annahmen für wiederholte Messungen zur korrekten Interpretation der SPSS-Ausgabe
Ich untersuche, ob unterschiedliche Belohnungsbedingungen die Aufgabenleistung beeinflussen können. Ich habe Daten aus einer kleinen Studie mit zwei Gruppen mit jeweils n = 20. Ich habe Daten zu einer Aufgabe gesammelt, die Leistung unter 3 verschiedenen "Belohnungsbedingungen" beinhaltete. Die Aufgabe umfasste die Ausführung in jeder der drei Bedingungen zweimal, jedoch …


1
Sollte der Unterschied zwischen Kontrolle und Behandlung explizit oder implizit modelliert werden?
Bei folgendem Versuchsaufbau: Von einem Probanden werden mehrere Proben entnommen und jede Probe wird auf verschiedene Arten behandelt (einschließlich einer Kontrollbehandlung). Was hauptsächlich interessant ist, ist der Unterschied zwischen der Kontrolle und jeder Behandlung. Ich kann mir zwei einfache Modelle für diese Daten vorstellen. Wenn Probe , Behandlung j , …


1
Inferenz im linearen Modell mit bedingter Heteroskedastizität
Angenommen, ich beobachte unabhängige Variablenvektoren und und die abhängige Variable . Ich möchte ein Modell der Form : wobei eine positiv differenzierte, doppelt differenzierbare Funktion ist, ein unbekannter Skalierungsparameter ist und eine Gaußsche Zufallsvariable mit einer mittleren Varianz von Null ist (von der angenommen wird, dass sie unabhängig von und …

2
Hat diese Distribution einen Namen? Oder was ist ein stochastischer Prozess, der ihn erzeugen könnte?
Eine diskrete Verteilung mit Massenfunktion p(x;k)=k(x+k)(x+k−1),x=1,2,…p(x;k)=k(x+k)(x+k−1),x=1,2,…p(x;k) = \frac{k}{(x+k)(x+k-1)},\quad x = 1,2,\ldots erscheint auf Seite 9 dieses Papiers . Für es eine Yule-Simon-Verteilung mit , aber ich habe keine anderen Beispiele gefunden.k=1k=1k=1ρ=1ρ=1\rho=1 Hat es einen Namen? Erscheint es in anderen Kontexten? Gibt es einen einfachen stochastischen Prozess, der ihn erzeugen könnte?

Durch die Nutzung unserer Website bestätigen Sie, dass Sie unsere Cookie-Richtlinie und Datenschutzrichtlinie gelesen und verstanden haben.
Licensed under cc by-sa 3.0 with attribution required.