Statistiken und Big Data

Fragen und Antworten für Personen, die sich für Statistik, maschinelles Lernen, Datenanalyse, Data Mining und Datenvisualisierung interessieren


2
Test auf Benutzereinstellungen
Ich habe einen Benutzertest generiert, um zwei Methoden zu vergleichen: M1 und M2. Ich generiere 40 Testfälle und zeige das Ergebnis jeder Methode im Testfall 20 Personen nebeneinander. Die Personen wissen nicht, welches Ergebnis von welcher Methode stammt. Für jeden Testfall muss jede Person sagen, ob das von M1 berechnete …

2
Wie kann eine Interaktion niedrigerer Ordnung interpretiert werden, wenn eine Interaktion höherer Ordnung von Bedeutung ist?
Ich habe eine Frage zur Interpretation von Interaktionstermen niedrigerer Ordnung bei Vorhandensein eines signifikanten Interaktionseffekts höherer Ordnung. Angenommen, ich habe ein 2 (Faktor ) 2 (Faktor ) 2 (Faktor ) -Design, bei dem die Wechselwirkung höchster Ordnung ( ) signifikant ist und ein Interaktionsterm niedrigerer Ordnung ( ) ist ebenfalls …

1
Warum ändert sich das Modell bei Verwendung von relevel?
Bei der Berechnung von Regressionsmodellen mit R verwende ich regelmäßig die Relevel-Funktion, damit mein Modell auch für die andere Ebene Ergebnisse liefert. Mir ist aufgefallen, dass dies manchmal, aber nicht oft, das Modell dahingehend veränderte, dass die Werte anderer Faktoren, die vor der Relevanz signifikant waren, nicht mehr vorhanden sind. …
8 r  regression 

2
Berechnung der hypergeometrischen Funktion in R.
Ich habe enorme Schwierigkeiten, 2 F 1 ( a , b ; c ; z ) mit dem Paket in R zu bewerten . In meinem Fall sind die Werte von a , b , c immer positive reelle Zahlen. Trotzdem ist die hypergeometrische Funktion unglaublich empfindlich gegenüber ihren Werten. …


3
Unit-Root-Tests für Paneldaten in R.
Ich habe das plmPaket und möchte Unit-Root-Tests für einige Variablen ausführen. Ich erhalte folgende Fehlermeldung: > purtest(data$tot.emp) Error in data.frame(baldwin = c(59870, 61259, 60397, 58919, 57856, 57227, : arguments imply differing number of rows: 14, 19, 11, 12, 1, 20, 18, 10, 13 Ich gehe davon aus, dass ich diesen …



2
Wie berechnet man mit winzigen Wahrscheinlichkeiten und großen Stichproben?
Ist es möglich, die Wahrscheinlichkeit zu berechnen oder zu approximieren, dass etwas äußerst Unwahrscheinliches einmal über eine große Stichprobe hinweg passiert, dh in Situationen, in denen die Wahrscheinlichkeit kleiner als der Maschinenfehler ist? Ich habe zum Beispiel versucht, die ungefähre Wahrscheinlichkeit zu berechnen, dass jemand mein Genom teilt. Anscheinend kann …


2
Ausgewogenes Design für wiederholte Maßnahmen
Okay, das ist mein Problem: Ich habe 12 Teilnehmer. Jeder Teilnehmer verbrachte drei Nächte in meinem Labor mit einer Reaktionszeitaufgabe zu vier Zeitpunkten in der Nacht (12, 1, 2 und 3 Uhr), wobei zwischen diesen Nächten jeweils eine Woche lag. Jede Nacht wurde jeder Teilnehmer einer von drei experimentellen Bedingungen …


1
Berechnen Sie den p-Wert im gepaarten Bootstrap
Ich bin auf ein neues Papier der Berkeley NLP-Gruppe über statistische Tests gestoßen, eine empirische Untersuchung der statistischen Signifikanz in NLP . Es gibt einen Pseudocode zum Berechnen eines p-Werts in der Arbeit. Grundsätzlich besteht die Idee darin, dass der Abtastsatz von x1,x2,...,xNx1,x2,...,xNx_1,x_2,...,x_N werden mit Ersetzung aus Daten abgetastet . …

2
Nicht korrelierte Fehler aus dem Generalized Least Square-Modell (GLS)
Als Finanzinstitut stoßen wir häufig auf die Analyse von Zeitreihendaten. Oft führen wir Regressionen mithilfe von Zeitreihenvariablen durch. Dabei stoßen wir häufig auf Residuen mit Zeitreihenstruktur, die gegen die Grundannahme unabhängiger Fehler in der OLS-Regression verstoßen. Kürzlich bauen wir ein weiteres Modell, in dem wir meiner Meinung nach eine Regression …

Durch die Nutzung unserer Website bestätigen Sie, dass Sie unsere Cookie-Richtlinie und Datenschutzrichtlinie gelesen und verstanden haben.
Licensed under cc by-sa 3.0 with attribution required.