Ich arbeite im Bereich Data Mining und habe nur sehr wenig formale Ausbildung in Statistik absolviert. In letzter Zeit habe ich viele Arbeiten gelesen, die sich auf Bayes'sche Paradigmen für Lernen und Bergbau konzentrieren, was ich sehr interessant finde. Meine Frage ist (in mehreren Teilen), ob es angesichts eines Problems …
Geschlossen. Diese Frage ist nicht zum Thema . Derzeit werden keine Antworten akzeptiert. Möchten Sie diese Frage verbessern? Aktualisieren Sie die Frage so dass es beim Thema für Kreuz Validated. Geschlossen vor 2 Jahren . Ich würde gerne lernen, Rcpp zu benutzen . Ich habe die Dokumente auf der CRAN-Website …
Ich vergleiche zwei Gruppen von Mutanten, von denen jede nur einen von 21 verschiedenen Phänotypen haben kann. Ich würde gerne sehen, ob die Verteilung dieser Ergebnisse auf zwei Gruppen ähnlich ist. Ich habe einen Online-Test gefunden , der den "Chi-Quadrat-Test für Verteilungsgleichheit" berechnet und mir einige plausible Ergebnisse liefert. Ich …
Was ist der Grund, wenn überhaupt, die Diskriminanzanalyse (Discriminant Analysis, DA) für die Ergebnisse eines Clustering-Algorithmus wie k-means zu verwenden, wie ich es von Zeit zu Zeit in der Literatur sehe (im Wesentlichen zur klinischen Subtypisierung von psychischen Störungen)? Es wird im Allgemeinen nicht empfohlen, Gruppenunterschiede bei den Variablen zu …
Ich muss eine binäre logistische Regression mit vielen unabhängigen Variablen durchführen. Die meisten von ihnen sind binär, aber einige der kategorialen Variablen haben mehr als zwei Ebenen. Was ist der beste Weg, um mit solchen Variablen umzugehen? Für eine Variable mit drei möglichen Werten müssen beispielsweise zwei Dummy-Variablen erstellt werden. …
Ich möchte Einzelhandelsartikel (nach Woche) mithilfe der exponentiellen Glättung prognostizieren. Ich bin gerade dabei, die Sesonalitätsindizes zu berechnen, zu speichern und anzuwenden. Das Problem ist, dass alle Beispiele, die ich gefunden habe, sich mit einer Art einfacher Saisonalität befassen. In meinem Fall habe ich folgende Probleme: 1. Jahreszeiten treten nicht …
Ich habe die Testergebnisse einer Blutuntersuchung, die 2500 Personen viermal im Abstand von sechs Monaten verabreicht wurde. Die Ergebnisse bestehen hauptsächlich aus zwei Messungen der Immunantwort - eine in Gegenwart bestimmter Tuberkulose-Antigene, eine in Abwesenheit. Derzeit wird jeder Test entweder positiv oder negativ bewertet, basierend auf dem Unterschied zwischen der …
Wenn die Annahme der Homoskedastizität getestet wird, stehen parametrische (Bartlett-Test der Homogenität von Varianzen bartlett.test) und nicht parametrische (Figner-Killeen-Test der Homogenität von Varianzen fligner.test) Tests zur Verfügung. Wie kann man feststellen, welche Art zu verwenden ist? Sollte dies zB von der Normalität der Daten abhängen?
Das qq-Diagramm kann verwendet werden, um zu visualisieren, wie ähnlich zwei Verteilungen sind (z. B. um die Ähnlichkeit einer Verteilung mit einer Normalverteilung zu visualisieren, aber auch um zwei Artibrary-Datenverteilungen zu vergleichen). Gibt es Statistiken, die ein objektiveres numerisches Maß erzeugen, das ihre Ähnlichkeit darstellt (vorzugsweise in normalisierter Form (0 …
Ich untersuche einige genomische Abdeckungsdaten, bei denen es sich im Grunde genommen um eine lange Liste (einige Millionen Werte) von ganzen Zahlen handelt, die jeweils angeben, wie gut (oder "tief") diese Position im Genom abgedeckt ist. Ich möchte in diesen Daten nach "Tälern" suchen, dh nach Regionen, die deutlich "niedriger" …
Ich mache eine Kernel-Dichteschätzung mit einem Satz gewichteter Punkte (dh jede Probe hat ein Gewicht, das nicht notwendig ist) in N-Dimensionen. Außerdem befinden sich diese Stichproben nur in einem metrischen Raum (dh wir können einen Abstand zwischen ihnen definieren), aber sonst nichts. Zum Beispiel können wir weder den Mittelwert der …
Welches Lernmaterial würden Sie einer CS-Person / einem unerfahrenen Statistiker / einem unerfahrenen Mathematiker vorschlagen, um in die prädiktive Analytik einzusteigen?
Ich suche nach der begrenzten Verteilung der multinomialen Verteilung über d Ergebnisse. IE, die Verteilung der folgenden limn→∞n−12Xnlimn→∞n−12Xn\lim_{n\to \infty} n^{-\frac{1}{2}} \mathbf{X_n} Wobei XnXn\mathbf{X_n} eine Vektorwert-Zufallsvariable mit der Dichte fn(x)fn(x)f_n(\mathbf{x}) für xx\mathbf{x} so dass ∑ixi=n∑ixi=n\sum_i x_i=n , xi∈Z,xi≥0xi∈Z,xi≥0x_i\in \mathbb{Z}, x_i\ge 0 und 0 für alle anderen xx\mathbf{x} , wobei fn(x)=n!∏i=1dpxiixi!fn(x)=n!∏i=1dpixixi!f_{n}(\mathbf{x})=n!\prod_{i=1}^d\frac{p_i^{x_i}}{x_i!} Ich …
Diese Frage passt derzeit nicht zu unserem Q & A-Format. Wir erwarten, dass die Antworten durch Fakten, Referenzen oder Fachwissen gestützt werden, aber diese Frage wird wahrscheinlich zu Debatten, Argumenten, Umfragen oder erweiterten Diskussionen führen. Wenn Sie der Meinung sind, dass diese Frage verbessert und möglicherweise erneut geöffnet werden kann, …
We use cookies and other tracking technologies to improve your browsing experience on our website,
to show you personalized content and targeted ads, to analyze our website traffic,
and to understand where our visitors are coming from.
By continuing, you consent to our use of cookies and other tracking technologies and
affirm you're at least 16 years old or have consent from a parent or guardian.