Statistiken und Big Data

Fragen und Antworten für Personen, die sich für Statistik, maschinelles Lernen, Datenanalyse, Data Mining und Datenvisualisierung interessieren

3
R Caret und NAs
Ich bevorzuge Caret wegen seiner Parametertuning-Fähigkeit und seiner einheitlichen Benutzeroberfläche, aber ich habe festgestellt, dass immer vollständige Datensätze (dh ohne NAs) erforderlich sind, auch wenn das angewendete "nackte" Modell NAs zulässt. Das ist sehr lästig, insofern sollte man arbeitsintensive Anrechnungsmethoden anwenden, die an erster Stelle nicht notwendig sind. Wie kann …

2
Sollten wir bei der Verwendung von Konfidenzintervallen mehrere Vergleichsanpassungen berücksichtigen?
Angenommen, wir haben ein Szenario mit mehreren Vergleichen, z. B. eine Post-Hoc- Folgerung für paarweise Statistiken oder eine multiple Regression, bei der wir insgesamt Vergleiche durchführen. Angenommen, wir möchten die Inferenz in diesen Multiplikatoren mithilfe von Konfidenzintervallen unterstützen.mmm 1. Wenden wir mehrere Vergleichsanpassungen auf CIs an? Das heißt, genau wie …

2
Warum funktioniert Pythons Scikit-Learn-LDA nicht richtig und wie berechnet es LDA über SVD?
Ich habe die lineare Diskriminanzanalyse (LDA) aus der scikit-learnmaschinellen Lernbibliothek (Python) zur Dimensionsreduktion verwendet und war ein wenig neugierig auf die Ergebnisse. Ich frage mich jetzt, was die LDA scikit-learntut, damit die Ergebnisse anders aussehen als beispielsweise ein manueller Ansatz oder eine in R durchgeführte LDA. Es wäre großartig, wenn …


1
Beziehung zwischen Variation Bayes und EM
Ich habe irgendwo gelesen, dass die Variational Bayes-Methode eine Verallgemeinerung des EM-Algorithmus ist. In der Tat sind die iterativen Teile der Algorithmen sehr ähnlich. Um zu testen, ob der EM-Algorithmus eine spezielle Version der Variational Bayes ist, habe ich Folgendes versucht: Y.Y.Y ist Daten, ist die Sammlung latenter Variablen und …

7
Testen von Verteilungshypothesen - Was bringt es, wenn Sie Ihre Nullhypothese nicht akzeptieren können?
Verschiedene Hypothesentests, wie der GOF-Test, Kolmogorov-Smirnov, Anderson-Darling usw., folgen diesem Grundformat:χ2χ2\chi^{2} : Die Daten folgen der angegebenen Verteilung.H0H0H_0 H1H1H_1 : Die Daten folgen nicht der angegebenen Verteilung. Typischerweise bewertet man die Behauptung, dass einige gegebene Daten einer gegebenen Verteilung folgen, und wenn man ablehnt , sind die Daten auf einer …

5
Intuitive Erklärung von Verteilungskonvergenz und Wahrscheinlichkeitskonvergenz
Was ist der intuitive Unterschied zwischen einer zufälligen Variablen, deren Wahrscheinlichkeit konvergiert, und einer zufälligen Variablen, deren Verteilung konvergiert? Ich habe zahlreiche Definitionen und mathematische Gleichungen gelesen, aber das hilft nicht wirklich. (Bitte denken Sie daran, dass ich Student im Grundstudium der Ökonometrie bin.) Wie kann eine Zufallsvariable zu einer …

1
One-vs-All und One-vs-One in SVM?
Was ist der Unterschied zwischen einem Eins-gegen-Alles- und einem Eins-gegen-Eins-SVM-Klassifikator? Bedeutet "Eins gegen Alles", dass ein Klassifizierer alle Typen / Kategorien des neuen Bildes klassifiziert, und "Eins gegen Eins", dass jeder Typ / jede Kategorie eines neuen Bildes mit einem anderen Klassifizierer klassifiziert wird (jede Kategorie wird von einem speziellen …

4
Der Unterschied der Kernel in SVM?
Kann mir bitte jemand den Unterschied zwischen den Kerneln in SVM erklären: Linear Polynom Gaußscher (RBF) Sigmoid Denn wie wir wissen, wird der Kernel verwendet, um unseren Eingaberaum in einen hochdimensionalen Merkmalsraum abzubilden. Und in diesem Merkmalsraum finden wir die linear trennbare Grenze. Wann und warum werden sie verwendet (unter …

2
Wie ist die Verteilung von in linearer Regression unter der Nullhypothese? Warum ist sein Modus nicht bei Null, wenn ?
Wie ist die Verteilung des Bestimmtheitsmaßes oder des quadratischen bei linearer univariater multipler Regression unter der Nullhypothese ?R2R2R^2H0:β=0H0:β=0H_0:\beta=0 Wie hängt es von der Anzahl der Prädiktoren kkk und der Anzahl der Stichproben n>kn>kn>k ? Gibt es einen Ausdruck in geschlossener Form für den Modus dieser Distribution? Insbesondere habe ich das …




2
Schätzen Sie das Quantil des Werts in einem Vektor
Ich habe eine Reihe von reellen Zahlen. Ich muss das Quantil einer neuen Zahl schätzen. Gibt es eine saubere Möglichkeit, dies in R zu tun? im Allgemeinen? Ich hoffe das ist nicht ultra-trivial ;-) Vielen Dank für Ihre Antwort. PK
26 r 


Durch die Nutzung unserer Website bestätigen Sie, dass Sie unsere Cookie-Richtlinie und Datenschutzrichtlinie gelesen und verstanden haben.
Licensed under cc by-sa 3.0 with attribution required.