Statistiken und Big Data

Fragen und Antworten für Personen, die sich für Statistik, maschinelles Lernen, Datenanalyse, Data Mining und Datenvisualisierung interessieren

3
Approximation von für eine diskrete Verteilung
Was ist der beste Weg, um für zwei gegebene ganze Zahlen zu approximieren wenn Sie den Mittelwert , die Varianz , die Schiefe und die überschüssige Kurtosis einer diskreten Verteilung und aus den (Nicht-Null-) Maßen der Form und dass eine normale Annäherung nicht angemessen ist?Pr[n≤X≤m]Pr[n≤X≤m]Pr[n \leq X \leq m]m,nm,nm,nμμ\muσ2σ2\sigma^2γ1γ1\gamma_1γ2γ2\gamma_2XXXγ1γ1\gamma_1γ2γ2\gamma_2 Normalerweise …

3
Ermitteln des durchschnittlichen GPS-Punkts
Ich muss ein Programm schreiben, um den durchschnittlichen GPS-Punkt aus einer Population von Punkten zu ermitteln. In der Praxis passiert Folgendes: Jeden Monat zeichnet eine Person einen GPS-Punkt desselben statischen Assets auf. Aufgrund der Art des GPS unterscheiden sich diese Punkte jeden Monat geringfügig. Manchmal macht die Person einen Fehler …
11 outliers  spatial 

1
Statistik basierend auf fraktaler Mathematik
Ich suche Bücher / Lehrbücher über Statistiken, die auf fraktaler Mathematik basieren. Ich weiß, dass es kein sehr bekanntes Gebiet ist und es ziemlich schwierig ist, gute Literatur zu finden. Vorschläge sind willkommen (Bücher, Lehrbücher, Online-Materialien).

6
Statistikbibliothek mit Rucksackbeschränkung
Angenommen, Sie hätten 200 US-Dollar für den Aufbau einer (sehr) kleinen Bibliothek mit Statistikbüchern. Was würden Sie wählen? Sie können davon ausgehen, dass der Versand von Amazon kostenlos ist und alle frei verfügbaren Texte aus dem Internet ein faires Spiel sind. Für den Druck wird jedoch eine Gebühr von 5 …

3
Wie bestelle oder rangiere ich eine Gruppe von Experten?
Ich habe eine Datenbank mit einer großen Anzahl von Experten auf einem Gebiet. Für jeden dieser Experten habe ich eine Vielzahl von Attributen / Datenpunkten wie: Anzahl Jahre Erfahrung. Lizenzen Anzahl der Bewertungen Textinhalt dieser Bewertungen Die 5-Sterne-Bewertung für jede dieser Bewertungen für eine Reihe von Faktoren wie Geschwindigkeit, Qualität …
11 rating  valuation 

6
Was ist Ihr Lieblingsproblem für eine Einführung in die Wahrscheinlichkeit?
Ich mag es, die Wahrscheinlichkeit einzuführen, indem ich das Paradoxon für Jungen oder Mädchen oder Bertrand diskutiere . Welches andere (kurze) Problem / Spiel bietet eine motivierende Einführung in die Wahrscheinlichkeit? ( Eine Antwort pro Antwort bitte ) PS Hier geht es um eine sanfte Einführung in die Wahrscheinlichkeit, aber …
11 teaching 

3
Wie können Sie feststellen, welche Studie die bessere ist, wenn Sie widersprüchliche Ergebnisse erhalten?
In der Presse stößt man so oft auf verschiedene Studien, die zu direkt entgegengesetzten Ergebnissen führen. Diese können mit dem Testen eines neuen verschreibungspflichtigen Arzneimittels oder dem Verdienst eines bestimmten Nährstoffs oder irgendetwas anderem in dieser Angelegenheit zusammenhängen. Wenn zwei solcher Studien zu widersprüchlichen Ergebnissen führen, wie können Sie dann …

4
Berechnung der Stichprobengröße für univariate logistische Regression
Wie berechnet man die Stichprobengröße, die für eine Studie benötigt wird, in der eine Kohorte von Probanden zum Zeitpunkt einer Operation eine einzige kontinuierliche Variable misst und diese zwei Jahre später als funktionelles Ergebnis oder beeinträchtigtes Ergebnis klassifiziert wird? Wir würden gerne sehen, ob diese Messung das schlechte Ergebnis hätte …

1
Was ist der Unterschied zwischen summary () und loadings () für das princomp () -Objekt in R?
Beispielcode: (pc.cr <- princomp(USArrests)) summary(pc.cr) loadings(pc.cr) ## note that blank entries are small but not zero Ich erhalte von jedem unterschiedliche Ausgänge und bin mir nicht sicher, ob ich den Unterschied verstehe. Hier ist die Ausgabe: > summary(pc.cr) Importance of components: Comp.1 Comp.2 Comp.3 Comp.4 Standard deviation 82.8908472 14.06956001 6.424204055 …
11 r  pca 

3
Sind diese Formeln für die Transformation von P, LSD, MSD, HSD, CI, SE als exakte oder aufgeblasen / konservative Schätzung von
Hintergrund Ich führe eine Metaanalyse durch, die zuvor veröffentlichte Daten enthält. Oft werden Unterschiede zwischen Behandlungen mit P-Werten, niedrigstwertigen Unterschieden (LSD) und anderen Statistiken angegeben, liefern jedoch keine direkte Schätzung der Varianz. Im Kontext des von mir verwendeten Modells ist eine Überschätzung der Varianz in Ordnung. Problem Hier ist eine …

4
Guter Text zu klinischen Studien?
Ich bin ein Student der Statistik, der nach einer guten Behandlung der Analyse klinischer Studien sucht. Der Text sollte unter anderem die Grundlagen des experimentellen Entwurfs, des Blockierens, der Leistungsanalyse, des Entwurfs lateinischer Quadrate und des Entwurfs der Cluster-Randomisierung abdecken. Ich habe Grundkenntnisse in mathematischer Statistik und realer Analyse, aber …

3
Was ist eine Konsistenzprüfung?
Mir wurde die Frage gestellt: "Haben Sie in Ihrer täglichen Arbeit eine Konsistenzprüfung durchgeführt?" während eines Telefoninterviews für eine Position als Biostatistiker. Ich weiß nicht, was ich antworten soll. Jede Information wird geschätzt.
11 validation 


6
Ist es angemessen, n-Punkt-Likert-Skalendaten als n Versuche aus einem Binomialprozess zu behandeln?
Ich habe nie gemocht, wie Leute normalerweise Daten von Likert-Skalen analysieren, als ob Fehler kontinuierlich und Gauß'sch wären, wenn vernünftige Erwartungen bestehen, dass diese Annahmen zumindest an den Extremen der Skalen verletzt werden. Was halten Sie von folgender Alternative: Wenn die Antwort auf einer Punkt-Skala den Wert annimmt , erweitern …


Durch die Nutzung unserer Website bestätigen Sie, dass Sie unsere Cookie-Richtlinie und Datenschutzrichtlinie gelesen und verstanden haben.
Licensed under cc by-sa 3.0 with attribution required.