Kontext Ich möchte die Szene einstellen, bevor ich die Frage etwas erweitere. Ich habe Längsschnittdaten, Messungen an Probanden ungefähr alle 3 Monate, primäres Ergebnis ist numerisch (wie kontinuierlich bis 1 dp) im Bereich von 5 bis 14, wobei der Großteil (aller Datenpunkte) zwischen 7 und 10 liegt. Wenn ich a …
Möglicherweise haben Sie von dem jüngsten Ausbruch von enterohämorrhagischem E. coli ( EHEC ) in Deutschland gehört . Welche Fragen würde ein Statistiker zur EHEC-Analyse stellen? Ich denke an Fragen und Antworten zwischen Reportern / Beamten - Nicht-Experten, sagen Lehrer und Ingenieure mit einem Diplom- / Master-Abschluss, aber höchstens ein …
Als Statistik- und R-Neuling hatte ich große Schwierigkeiten, qqplots mit einem Seitenverhältnis von 1: 1 zu erstellen. ggplot2 scheint weitaus mehr Kontrolle über das Plotten zu bieten als die Standard-R-Plot-Pakete, aber ich kann nicht sehen, wie ein qqplot in ggplot2 durchgeführt wird, um zwei Datensätze zu vergleichen. Also meine Frage, …
Gibt es eine Möglichkeit, nach Erstellung eines komplexen Klassifizierungsbaums mit rpart (in R) die für jede Klasse erstellten Entscheidungsregeln zu organisieren? Anstatt also einen riesigen Baum zu bekommen, bekommen wir eine Reihe von Regeln für jede der Klassen? (Wenn das so ist, wie?) Hier ist ein einfaches Codebeispiel, um Beispiele …
Ich arbeite mit einigen großen Datenmengen unter Verwendung des gbm-Pakets in R. Sowohl meine Prädiktormatrix als auch mein Antwortvektor sind ziemlich spärlich (dh die meisten Einträge sind Null). Ich hatte gehofft, Entscheidungsbäume mit einem Algorithmus zu erstellen, der diese Spärlichkeit ausnutzt, wie hier ). In diesem Artikel haben, wie in …
Ich unterrichte einen Einführungskurs in Wirtschaftsgeographie. Um meinen Schülern zu helfen, ein besseres Verständnis für die Arten von Ländern in der heutigen Weltwirtschaft und ein Verständnis für Datenreduktionstechniken zu entwickeln, möchte ich eine Aufgabe erstellen, die eine Typologie verschiedener Arten von Ländern erstellt (z. B. einkommensstarke Länder mit hohem Einkommen) …
Ich habe eine breite Palette von Tests für meine Abschlussarbeiten verwendet, von parametrischen ANOVAs und t-Tests über nichtparametrische Kruskal-Wallis-Tests und Mann-Whitneys bis hin zu rangtransformierten 2-Wege-ANOVAs und GzLMs mit binären. Poisson und proportionale Daten. Jetzt muss ich alles melden, während ich das alles in meine Ergebnisse schreibe. Ich habe hier …
Das "Linear Ballistic Accumulator" -Modell (LBA) ist ein ziemlich erfolgreiches Modell für menschliches Verhalten bei beschleunigten einfachen Entscheidungsaufgaben. Donkin et al (2009, PDF ) zur Verfügung stellt Code, erlaubt es, die Parameter des Modells gegeben menschliche Verhaltensdaten zu schätzen, und ich habe diesen Code kopiert (mit einigen kleineren Formatierungsänderungen) auf …
Der klassische F-Test für Teilmengen von Variablen in der multilinearen Regression hat die Form wobei die Summe der quadratischen Fehler unter dem 'reduzierten' Modell ist, das im 'großen' Modell ist , und die Freiheitsgrade der zwei Modelle. Unter der Nullhypothese, dass die zusätzlichen Variablen im 'großen' Modell keine lineare Erklärungskraft …
Was sind die Vorteile der Angabe bestimmter Anfangswerte für Übergangswahrscheinlichkeiten in einem Hidden-Markov-Modell? Irgendwann wird das System sie lernen. Was bringt es also, andere als zufällige Werte anzugeben? Macht der zugrunde liegende Algorithmus einen Unterschied wie Baum-Welch? Was würden Sie mir raten, wenn ich die Übergangswahrscheinlichkeiten zu Beginn sehr genau …
Ich verwende die latente semantische Indizierung, um Ähnlichkeiten zwischen Dokumenten zu finden ( danke, JMS! ) Nach der Dimensionsreduzierung habe ich versucht, mit k-means Clustering die Dokumente in Cluster zu gruppieren, was sehr gut funktioniert. Ich möchte jedoch noch einen Schritt weiter gehen und die Dokumente als eine Reihe von …
Ich möchte einen Klassifikator, z. B. SVM, eine zufällige Gesamtstruktur oder einen anderen Klassifikator trainieren. Eine der Funktionen im Datensatz ist eine kategoriale Variable mit 1000 Ebenen. Was ist der beste Weg, um die Anzahl der Ebenen in dieser Variablen zu reduzieren. In R gibt es eine Funktion combine.levels()im Hmisc- …
Eine typische Bildverarbeitungsstatistik ist die Verwendung von Haralick-Texturmerkmalen (14). Ich wundere mich über das 14. dieser Merkmale: Bei gegebener Adjazenzkarte (die wir einfach als empirische Verteilung von zwei ganzen Zahlen i , j < 256 betrachten können ) ist sie definiert als: die Quadratwurzel des zweiten Eigenwerts von Q , …
Geschlossen . Diese Frage basiert auf Meinungen . Derzeit werden keine Antworten akzeptiert. Möchten Sie diese Frage verbessern? Aktualisieren Sie die Frage, damit sie durch Bearbeiten dieses Beitrags mit Fakten und Zitaten beantwortet werden kann . Geschlossen vor 5 Monaten . Hintergrund Ich habe über StatProb.com aus einem Kommentar in …
Ich habe die Gesamtzahl der wöchentlich eingegangenen Anrufe und habe sie in einem Diagramm aufgezeichnet, das fast drei Jahre zurückliegt. Auf den ersten Blick scheint es über Weihnachten einen massiven Rückgang gegeben zu haben, der sich nicht erholt zu haben scheint. Es scheint, dass sich die Anfragen schrittweise geändert haben. …
We use cookies and other tracking technologies to improve your browsing experience on our website,
to show you personalized content and targeted ads, to analyze our website traffic,
and to understand where our visitors are coming from.
By continuing, you consent to our use of cookies and other tracking technologies and
affirm you're at least 16 years old or have consent from a parent or guardian.