Mein Hintergrund liegt hauptsächlich im maschinellen Lernen und ich habe versucht zu lernen, was das Testen der Bayes'schen Hypothese bedeutet. Ich bin mit der Bayes'schen Interpretation der Wahrscheinlichkeit einverstanden und im Kontext probabilistischer grafischer Modelle damit vertraut. Was mich jedoch verwirrt, ist die Bedeutung des Wortes "Hypothese" im Zusammenhang mit …
In den Videovorträgen von Harvards Statistikkurs 110: Wahrscheinlichkeitsrechnung , die auf iTunes und YouTube zu finden sind, bin ich auf dieses Problem gestoßen . Ich habe versucht, es hier zusammenzufassen: Angenommen, wir erhalten eine zufällige Zwei-Karten-Hand aus einem Standardstapel. Wie groß ist die Wahrscheinlichkeit, dass beide Karten Asse sind, vorausgesetzt, …
Ich habe kürzlich eine Data Science-Interviewressource gekauft, in der eine der Wahrscheinlichkeitsfragen wie folgt lautete: Wie kann man bei gegebenen Ziehungen aus einer Normalverteilung mit bekannten Parametern Ziehungen aus einer Gleichverteilung simulieren? Mein ursprünglicher Denkprozess war, dass wir für eine diskrete Zufallsvariable die Normalverteilung in K eindeutige Unterabschnitte aufteilen könnten, …
Ich habe Stichproben aus einem stark verzerrten Datensatz (der wie eine Exponentialverteilung aussieht) über die Teilnahme von Benutzern (z. B. Anzahl der Beiträge), die unterschiedliche Größen haben (aber nicht weniger als 200), und ich möchte deren Mittelwert vergleichen. Dafür verwende ich ungepaarte T-Tests mit zwei Stichproben (und T-Tests mit dem …
Ich habe zwei Datensätze und möchte wissen, ob sie sich erheblich unterscheiden oder nicht (dies kommt von " Zwei Gruppen unterscheiden sich erheblich? Test zu verwenden "). Ich habe mich für einen Permutationstest entschieden und in R Folgendes durchgeführt: permutation.test <- function(coding, lncrna) { coding <- coding[,1] # dataset1 lncrna …
In einem Modell mit gemischten Effekten wird empfohlen, einen Parameter anhand eines festen Effekts zu schätzen, wenn alle möglichen Werte enthalten sind (z. B. sowohl Männer als auch Frauen). Es wird weiterhin empfohlen, einen Zufallseffekt zu verwenden, um eine Variable zu berücksichtigen, wenn die enthaltenen Werte nur eine Zufallsstichprobe aus …
Ist es sinnvoll und möglich, einen einseitigen KS-Test durchzuführen? Was wäre die Nullhypothese eines solchen Tests? Oder ist der KS-Test von Natur aus ein zweiseitiger Test? Ich würde von einer Antwort profitieren, die mir hilft, die Verteilung von D zu verstehen (ich arbeite mich in Masseys Arbeit von 1951 durch …
Ich habe zwei Variablen - X und Y und ich muss den Cluster maximal (und optimal) = 5 machen. Der ideale Plot von Variablen sieht folgendermaßen aus: Ich würde gerne 5 Cluster daraus machen. Etwas wie das: Daher denke ich, dass dies ein Mischungsmodell mit 5 Clustern ist. Jeder Cluster …
Ich versuche herauszufinden , ob Ridge Regression , LASSO , Principal Component Regression (PCR) oder Partial Least Squares (PLS) in einer Situation mit einer großen Anzahl von Variablen / Merkmalen ( ) und einer geringeren Anzahl von Stichproben ( ), und mein Ziel ist die Vorhersage.pppn<pn<pn n , meistens ;p>10np>10np>10n …
\newcommand{\E}{\mathbb{E}} Wie lautet die -Normalisierungstransformation für die Exponentialfamilie? abgeleitet? A ( ⋅ ) = ∫ d uV 1 / 3 ( μ )A(⋅)=∫duV1/3(μ)A(\cdot) = \displaystyle\int\frac{du}{V^{1/3}(\mu)} Genauer gesagt : Ich habe versucht, der Taylor-Erweiterungsskizze auf Seite 3, Folie 1, zu folgen, habe aber mehrere Fragen. Mit aus einer Exponentialfamilie, Transformation und …
Originalfrage (25.07.14): Ist dieses Zitat aus den Nachrichtenmedien sinnvoll, oder gibt es eine bessere statistische Sichtweise auf die jüngsten Flugzeugunfälle? Barnett macht jedoch auch auf die Theorie der Poisson-Verteilung aufmerksam, wonach kurze Absturzintervalle wahrscheinlicher sind als lange. "Nehmen wir an, es gibt durchschnittlich einen tödlichen Unfall pro Jahr, was bedeutet, …
Ich habe gehört, dass die Gratregression als Mittelwert einer posterioren Verteilung abgeleitet werden kann, wenn der Prior angemessen gewählt wird. Ist die Intuition, dass die Einschränkungen, die für die Regressionskoeffizienten durch den Prior festgelegt wurden (z. B. Standardnormalverteilungen um 0), identisch sind / ersetzen die Strafe, die für die quadratische …
Hinweis: Es werden jetzt 50 Rohdatenpunkte angehängt. Ich möchte anzeigen, wie viel und wie viele Seiten ich im Laufe der Woche nach Tagen aufgeteilt und wie unten gezeigt absolviert habe: Die Leute haben mir gesagt, dass sie die Grafiken nicht verstehen können, aber ich habe keine Ahnung, wie ich sie …
Gibt es einen Referenzthesaurus für Statistiken und Begriffe des maschinellen Lernens? Ich weiß, dass Wikipedia-Artikel häufig Synonyme enthalten, aber ich hätte gerne einen bloßen Thesaurus, den ich einfach durchgehen könnte (im Gegensatz zu einer vollständigen Enzyklopädie), um sicherzustellen, dass ich den gesamten Jargon kenne.
Ich habe einen Datensatz mit einigen Millionen Zeilen und ~ 100 Spalten. Ich möchte ungefähr 1% der Beispiele im Datensatz erkennen, die zu einer gemeinsamen Klasse gehören. Ich habe eine minimale Genauigkeitsbeschränkung, aber aufgrund der sehr asymmetrischen Kosten bin ich nicht besonders an einem bestimmten Rückruf interessiert (solange mir nicht …
We use cookies and other tracking technologies to improve your browsing experience on our website,
to show you personalized content and targeted ads, to analyze our website traffic,
and to understand where our visitors are coming from.
By continuing, you consent to our use of cookies and other tracking technologies and
affirm you're at least 16 years old or have consent from a parent or guardian.