Statistiken und Big Data

Fragen und Antworten für Personen, die sich für Statistik, maschinelles Lernen, Datenanalyse, Data Mining und Datenvisualisierung interessieren



2
Leidet LASSO an den gleichen Problemen wie die schrittweise Regression?
Stufenweise algorithmische Variablenauswahlmethoden neigen dazu, Modelle auszuwählen, die mehr oder weniger jede Schätzung in Regressionsmodellen beeinflussen ( s und ihre SEs, p- Werte, F- Statistiken usw.), und schließen mit etwa der gleichen Wahrscheinlichkeit echte Prädiktoren aus wie schließen falsche Prädiktoren gemäß einer einigermaßen ausgereiften Simulationsliteratur ein.ββ\beta Leidet der LASSO bei …

3
Sind MCMC ohne Speicher?
Ich versuche zu verstehen, was Markov-Kette Monte Carlo (MCMC) von der französischen Wikipedia-Seite sind. Sie sagen, "dass die Markov-Ketten-Monte-Carlo-Methoden darin bestehen, einen Vektor xichxichx_ {i} nur aus den Vektordaten xi - 1xich-1x_ {i-1} erzeugen, es ist daher ein Prozess" ohne Speicher "." Les méthodes de Monte-Carlo par chaînes de Markov …
18 mcmc 

2
Ist es sinnvoll, die logistische Regression mit binärem Ergebnis und Prädiktor zu verwenden?
Ich habe eine binäre Ergebnisvariable {0,1} und eine Prädiktorvariable {0,1}. Ich bin der Meinung, dass es keinen Sinn macht, logistisch zu arbeiten, wenn ich nicht andere Variablen einbeziehe und die Odds Ratio berechne. Würde die Berechnung der Wahrscheinlichkeit bei einem binären Prädiktor nicht ausreichen, um das Quotenverhältnis zu bestimmen?

1
Wann wurde auf mittlere prägte das Wort „bias“
Wann bedeutete das Wort "Voreingenommenheit" ?E[θ^−θ]E[θ^−θ]\mathbb{E}[\hat{\theta}-\theta] Der Grund, warum ich gerade darüber nachdenke, ist, dass ich mich an Jaynes in seinem Wahrscheinlichkeitstheoretiktext zu erinnern scheine , der die Verwendung des Wortes "Voreingenommenheit" zur Beschreibung dieser Formel kritisiert und eine Alternative vorschlägt. Aus Jaynes ' Wahrscheinlichkeitstheorie , Abschnitt 17.2 "Unvoreingenommene Schätzer:" …


3
Wie kann man Daten simulieren, um statistisch signifikant zu sein?
Ich bin in der 10. Klasse und möchte Daten für ein Projekt auf einer Messe für maschinelles Lernen simulieren. Das endgültige Modell wird für Patientendaten verwendet und sagt die Korrelation zwischen bestimmten Zeiten der Woche und den Auswirkungen voraus, die dies auf die Medikamenteneinhaltung innerhalb der Daten eines einzelnen Patienten …




11
Ein Begriff für die Anzahl der Spalten einer Matrix
Gibt es ein einzelnes englisches Wort, um die "Anzahl der Spalten" einer Matrix zu bezeichnen? Zum Beispiel ist "Dimensionalität" einer Matrix . In diesem Beispiel brauche ich einen Term für . Ich kann natürlich immer nur "Anzahl der Spalten" sagen, aber könnte ich ein einziges Wort dafür haben?2 × 32×32\times …

3
Ikonenhafte (Spielzeug-) Modelle neuronaler Netze
Meine Physikprofessoren an der Graduiertenschule sowie der Nobelpreisträger Feynman präsentierten immer das, was sie Spielzeugmodelle nannten, um grundlegende Konzepte und Methoden der Physik wie den harmonischen Oszillator, das Pendel, den Kreisel und die Black Box zu veranschaulichen. Welche Spielzeugmodelle werden verwendet, um die grundlegenden Konzepte und Methoden zu veranschaulichen, die …


6
Lineare Regression oder ordinale logistische Regression zur Vorhersage der Weinbewertung (von 0 bis 10)
Ich habe die Weindaten von hier, die aus 11 numerisch unabhängigen Variablen mit einer abhängigen Bewertung bestehen, die jedem Eintrag mit Werten zwischen 0 und 10 zugeordnet sind. Dies macht es zu einem großartigen Datensatz, ein Regressionsmodell zu verwenden, um die Beziehung zwischen den Variablen und den zugeordneten zu untersuchen …

Durch die Nutzung unserer Website bestätigen Sie, dass Sie unsere Cookie-Richtlinie und Datenschutzrichtlinie gelesen und verstanden haben.
Licensed under cc by-sa 3.0 with attribution required.