Ich bin ein Doktorand. Ich arbeite mit einem Datensatz von Zähldaten. Es gibt eine Anzahl von Benutzern, die an einem n-way Echtzeit-Chat-Gespräch beteiligt sind. Die Anzahl der Benutzer reicht von 1 bis 6 und das Set enthält ca. 300 Daten. Meine anfängliche Motivation war zu verstehen, ob die Daten zu …
Gibt es gute Beispiele für ein scheinbar einfaches Wahrscheinlichkeitsproblem, das tatsächlich nicht zu lösen ist? Ich versuche, den Einsatz von Simulationen zu motivieren, und möchte ein Beispiel dafür geben, wann es notwendig ist, dass es zugänglich ist. Die Hoffnung ist so etwas wie: "Intuitiv scheint es einfach genug zu sein, …
Ich versuche die Verteilung der Summe von 2 logarithmischen Zufallsvariablen zu finden. Ich habe mich auf die Literatur zu Cross Validated, Stack Overflow und einigen Veröffentlichungen bezogen, bevor ich diese veröffentlichte. Ich habe Faltung verwendet, um die Verteilung der Summe von 2 logarithmischen rvs zu finden. Die Näherung funktioniert für …
Ich studiere derzeit "Gaußsche Prozesse für maschinelles Lernen" und in Kapitel 3 heißt es, dass das hintere (Gleichung 3.10) und das latente Die Variable posterior (Gleichung 3.9) kann aufgrund der Sigmoidwahrscheinlichkeiten in (3.9) und der Sigmoidfunktion in (3.10) im Allgemeinen nicht analytisch gelöst werden ). Um zu verhindern, dass Personen …
Ich habe monatliche Preisdaten für eine Ware von 2007 bis 2017. Sie finden sie unter folgendem Link: https://drive.google.com/open?id=0BxRCOgKAL4itcUZlOExrUmVOanc Ich muss sie für das nächste mit dem saisonalen ARIMA-Modell in R prognostizieren Jahr. Wenn ich die auto.arimaFunktion verwende, wird mir das beste Modell ARIMA(0,1,1)anstelle von vorgeschlagen ARIMA(p,d,q)(P,D,Q)12. Der saisonale Teil des …
Ich versuche mithilfe der Hauptkomponentenanalyse zu untersuchen, ob es möglich ist, mit gutem Vertrauen zu erraten, aus welcher Population ("Aurignacian" oder "Gravettian") ein neuer Datenpunkt stammt. Ein Datenpunkt wird durch 28 Variablen beschrieben, von denen die meisten relative Häufigkeiten archäologischer Artefakte sind. Die verbleibenden Variablen werden als Verhältnisse anderer Variablen …
Angenommen, Sie trainieren zwei verschiedene Gradient Boosting Classifier-Modelle für zwei verschiedene Datensätze. Sie verwenden eine einmalige Kreuzvalidierung und zeichnen die Histogramme der Vorhersagen auf, die die beiden Modelle ausgeben. Die Histogramme sehen folgendermaßen aus: und das: In einem Fall sind die Vorhersagen (für Sätze außerhalb der Stichprobe / Validierung) meist …
Angenommen, wir haben einen Datensatz mit Millionen Zeilen und Tausenden Spalten und die Aufgabe ist die binäre Klassifizierung. Wenn wir ein logistisches Regressionsmodell ausführen, ist die Leistung viel besser als erwartet, z. B. eine nahezu perfekte Klassifizierung. Wir vermuten, dass die Daten einige betrügerische Variablen enthalten. Wie kann ich sie …
Während ich jemand anderem bei seinen Analysen half, stieß ich auf eine Frage bezüglich des Unterschieds zwischen t-Tests und F-Tests für lineare gemischte Modelle in lme4 für R, wie von lmerTest bereitgestellt. Ich bin mir der Probleme bei der Berechnung jeglicher Art von p-Werten für lineare gemischte Modelle bewusst (wie …
Wenn bei Regressionsproblemen die Ausgabe in Bins / Kategorien / Cluster diskretisiert und als Beschriftungen verwendet wird, wird das Modell auf ein Klassifizierungsmodell reduziert. Meine Frage ist: Was ist die theoretische oder angewandte Motivation für diese Reduzierung? In meinen speziellen Experimenten zur Vorhersage des Standorts anhand von Text habe ich …
Laut Karl Popper sind nur fälschbare Hypothesen wirklich wissenschaftlich (zitiert Wikipedia ): Keine Anzahl positiver Ergebnisse auf der Ebene experimenteller Tests kann eine wissenschaftliche Theorie bestätigen, aber ein einziges Gegenbeispiel ist logisch entscheidend: Es zeigt, dass die Theorie, aus der die Implikation abgeleitet wird, falsch ist. Welcher statistische Rahmen ist …
In einem Übersichtsartikel aus dem Jahr 2013 in Nature Neuroscience haben Button et al. Stromausfall: Warum eine kleine Stichprobengröße die Zuverlässigkeit der Neurowissenschaften untergräbt , wurde festgestellt, dass: Die durchschnittliche statistische Aussagekraft von Studien in den Neurowissenschaften ist sehr gering Sie suchten nach Metaanalysen, berechneten die Post-hoc-Leistung in jeder von …
Geschlossen. Diese Frage ist nicht zum Thema . Derzeit werden keine Antworten akzeptiert. Möchten Sie diese Frage verbessern? Aktualisieren Sie die Frage so dass es beim Thema für Kreuz Validated. Geschlossen vor 2 Jahren . Ich habe also eine Reihe von Tweets mit ein paar Spalten wie Datum und Tweet …
Ich lese Why Momentum Really Works , einen Beitrag aus dem neuen Destillationsjournal. Ich werde die Hauptgleichungen umschreiben, die zu dem Teil führen, der mich verwirrt. Der Beitrag beschreibt die Intuition genauer. Der Gradientenabstiegsalgorithmus ist durch den folgenden iterativen Prozess gegeben: wobei der Wert der Iteration , die Lernrate und …
Für eine Präsentation muss ich dreidimensionale Daten visualisieren. Ich sollte sie im "Stil eines Streudiagramms" visualisieren. Mai waren erste Ideen Ein dreidimensionales Streudiagramm Eine Streudiagramm-Matrix Dimensionalitätsreduktion (PCA) und anschließend ein zweidimensionales Streudiagramm Was sind Alternativen zu diesen Konzepten? Wenn möglich, geben Sie R-Code in Ihre Antwort ein. Bearbeiten: Ich habe …
We use cookies and other tracking technologies to improve your browsing experience on our website,
to show you personalized content and targeted ads, to analyze our website traffic,
and to understand where our visitors are coming from.
By continuing, you consent to our use of cookies and other tracking technologies and
affirm you're at least 16 years old or have consent from a parent or guardian.