Statistiken und Big Data

Fragen und Antworten für Personen, die sich für Statistik, maschinelles Lernen, Datenanalyse, Data Mining und Datenvisualisierung interessieren

3
Richtige Statistiken in einer Arbeitsumgebung erstellen?
Ich bin nicht sicher, wo diese Frage hingehört: Cross Validated oder The Workplace. Aber meine Frage hängt vage mit der Statistik zusammen. Diese Frage (oder ich nehme an, Fragen) stellte sich während meiner Arbeit als "Praktikant im Bereich Data Science". Ich habe dieses lineare Regressionsmodell erstellt und die Restkurve untersucht. …
20 careers 


2
Beweisen Sie, dass die F-Statistik der F-Verteilung folgt
In Anbetracht dieser Frage: Beweisen Sie, dass die Koeffizienten in einem OLS-Modell einer t-Verteilung mit (nk) Freiheitsgraden folgen Ich würde gerne verstehen warum F=(TSS−RSS)/(p−1)RSS/(n−p),F=(TSS−RSS)/(p−1)RSS/(n−p), F = \frac{(\text{TSS}-\text{RSS})/(p-1)}{\text{RSS}/(n-p)}, wobei ppp die Anzahl der Modellparameter und ist nnn die Anzahl der Beobachtungen und TSSTSSTSS die Gesamtvarianz, RSSRSSRSS die Residuenvarianz, ein folgt Fp−1,n−pFp−1,n−pF_{p-1,n-p} …

1
Wavelet-Domain-Gauß-Prozesse: Was ist die Kovarianz?
Ich habe Maraun et al . Gelesen, "Nichtstationäre Gauß-Prozesse im Wavelet-Bereich: Synthese, Abschätzung und signifikante Tests" (2007), die eine Klasse von nichtstationären GPs definieren, die durch Multiplikatoren im Wavelet-Bereich spezifiziert werden können. Eine Realisierung eines solchen GP ist: wobei weißes Rauschen ist, die kontinuierliche Wavelet-Transformation in Bezug auf Wavelet , …

5
Wirf einen Würfel, bis er auf einer anderen Zahl als 4 landet. Wie groß ist die Wahrscheinlichkeit, dass das Ergebnis> 4 ist?
Ein Spieler erhält einen fairen sechsseitigen Würfel. Um zu gewinnen, muss sie eine Zahl größer als 4 würfeln (dh eine 5 oder eine 6). Wenn sie eine 4 würfelt, muss sie erneut würfeln. Was sind ihre Gewinnchancen? Ich denke, die Wahrscheinlichkeit, P(W)P(W)P(W) , kann rekursiv ausgedrückt werden als: P(W)=P(r=5∪r=6)+P(r=4)⋅P(W)P(W)=P(r=5∪r=6)+P(r=4)⋅P(W) P(W) …



4
Was ist der Unterschied zwischen Lernen und Inferenz?
Forschungsarbeiten zum maschinellen Lernen behandeln Lernen und Inferenz oft als zwei getrennte Aufgaben, aber es ist mir nicht ganz klar, worin der Unterschied besteht. In diesem Buch verwenden sie zum Beispiel Bayes-Statistiken für beide Arten von Aufgaben, liefern jedoch keine Motivation für diese Unterscheidung. Ich habe einige vage Ideen, worum …


3
Warum hat der AUC = 1-Klassifikator die Hälfte der Stichproben falsch klassifiziert?
Ich benutze einen Klassifikator, der Wahrscheinlichkeiten zurückgibt. Zur Berechnung der AUC verwende ich das pROC R-Paket. Die Ausgabewahrscheinlichkeiten des Klassifikators sind: probs=c(0.9865780, 0.9996340, 0.9516880, 0.9337157, 0.9778576, 0.8140116, 0.8971550, 0.8967585, 0.6322902, 0.7497237) probszeigt die Wahrscheinlichkeit, in der Klasse '1' zu sein. Wie gezeigt, hat der Klassifikator alle Proben in Klasse '1' …

3
Soll ich immer das wahrscheinlichste Ergebnis wählen, um die Chance zu maximieren, das Ergebnis eines Münzwurfs richtig zu erraten?
Das sind keine Hausaufgaben. Ich bin daran interessiert zu verstehen, ob meine Logik bei diesem einfachen Statistikproblem richtig ist. Angenommen, ich habe eine 2-seitige Münze, bei der die Wahrscheinlichkeit, einen Kopf umzudrehen, und die Wahrscheinlichkeit, einen Schwanz umzudrehen, beträgt . Nehmen wir an, dass alle Flips unabhängige Wahrscheinlichkeiten haben. Nehmen …

4
Codierungswinkeldaten für neuronales Netzwerk
Ich trainiere ein neuronales Netzwerk (Details nicht wichtig), bei dem die Zieldaten ein Winkelvektor sind (zwischen 0 und 2 * pi). Ich suche Rat, wie ich diese Daten verschlüsseln kann. Folgendes versuche ich derzeit (mit begrenztem Erfolg): 1) 1-von-C-Codierung: Ich bin die eingestellten möglichen Winkel in etwa 1000 diskrete Winkel …

1
Können Splines zur Vorhersage verwendet werden?
Ich kann nicht genau sagen, um welche Art von Daten es sich handelt, da es sich um geschützte Daten handelt. Nehmen wir jedoch an, wir haben folgende Daten: Jeden Monat melden sich einige Personen für einen Dienst an. In jedem darauffolgenden Monat können diese Personen den Service aktualisieren, den Service …

9
Woher wissen wir, dass die Wahrscheinlichkeit, 1 und 2 zu würfeln, 1/18 beträgt?
Seit meiner ersten Wahrscheinlichkeitsklasse habe ich mich über Folgendes gewundert. Die Berechnung der Wahrscheinlichkeiten erfolgt in der Regel über das Verhältnis der "favorisierten Ereignisse" zu den insgesamt möglichen Ereignissen. Beim Würfeln von zwei 6-seitigen Würfeln beträgt die Anzahl der möglichen Ereignisse 363636 , wie in der folgenden Tabelle dargestellt. 1234561(1,1)(2,1)(3,1)(4,1)(5,1)(6,1)2(1,2)(2,2)(3,2)(4,2)(5,2)(6,2)3(1,3)(2,3)(3,3)(4,3)(5,3)(6,3)4(1,4)(2,4)(3,4)(4,4)(5,4)(6,4)5(1,5)(2,5)(3,5)(4,5)(5,5)(6,5)6(1,6)(2,6)(3,6)(4,6)(5,6)(6,6)1234561(1,1)(1,2)(1,3)(1,4)(1,5)(1,6)2(2,1)(2,2)(2,3)(2,4)(2,5)(2,6)3(3,1)(3,2)(3,3)(3,4)(3,5)(3,6)4(4,1)(4,2)(4,3)(4,4)(4,5)(4,6)5(5,1)(5,2)(5,3)(5,4)(5,5)(5,6)6(6,1)(6,2)(6,3)(6,4)(6,5)(6,6)\begin{array} …
20 probability  dice 

1
Wenn das LASSO einer linearen Regression mit einem Laplace entspricht, wie kann es Masse auf Mengen mit Komponenten bei Null geben?
Wir alle kennen die in der Literatur gut dokumentierte Vorstellung, dass die LASSO-Optimierung (der Einfachheit halber hier auf den Fall der linearen Regression beschränkt) ist äquivalent zu dem linearen Modell mit Gaußschen Fehlern, bei dem die Parameter mit dem Laplace-Prioritätswert sind. , je größer der Anteil der Parameter ist, desto …

Durch die Nutzung unserer Website bestätigen Sie, dass Sie unsere Cookie-Richtlinie und Datenschutzrichtlinie gelesen und verstanden haben.
Licensed under cc by-sa 3.0 with attribution required.