Statistiken und Big Data

Fragen und Antworten für Personen, die sich für Statistik, maschinelles Lernen, Datenanalyse, Data Mining und Datenvisualisierung interessieren






1
Sind robuste Methoden wirklich besser?
Ich habe zwei Gruppen von Probanden, A und B, jede mit einer Größe von ungefähr 400 und ungefähr 300 Prädiktoren. Mein Ziel ist es, ein Vorhersagemodell für eine binäre Antwortvariable zu erstellen. Mein Kunde möchte das Ergebnis der Anwendung des von A auf B erstellten Modells sehen. (In seinem Buch …


3
Gratregression implementieren: Intelligentes Gitter für ?
Ich implementiere Ridge Regression in einem Python / C-Modul und bin auf dieses "kleine" Problem gestoßen. Die Idee ist, dass ich die effektiven Freiheitsgrade mehr oder weniger gleichmäßig verteilt abtasten möchte (wie die grafische Darstellung auf Seite 65 unter "Elemente des statistischen Lernens" ), dh Beispiel: wobei die Eigenwerte der …

2
Frequentismus und Priors
Robby McKilliam sagt in einem Kommentar zu diesem Beitrag: Es sollte darauf hingewiesen werden, dass es aus Sicht der Frequentisten keinen Grund gibt, das Vorwissen nicht in das Modell zu integrieren. In diesem Sinne ist die frequentistische Ansicht einfacher, Sie haben nur ein Modell und einige Daten. Es ist nicht …

4
Wie würde man die Ergebnisse der subjektiven Rangfolge grafisch darstellen?
Ich suche nach einer Möglichkeit, subjektive Rankings zu visualisieren, unabhängig von meinen nicht-parametrischen Tests. Ich habe 12 Teilnehmer gebeten, 8 verschiedene Gegenstände nach unterschiedlichen subjektiven Kriterien zu bewerten (getrennte Bewertungen für jeden einzelnen). Für jede einzelne Rangfolge suche ich nach einer guten Möglichkeit, die übergeordneten Trends der Rangfolgen zu visualisieren. …

2
Kontingenztabellen: Welche Tests sind wann durchzuführen?
Ich würde gerne eine Erweiterung dieser Diskussion über die exakte Testdebatte zwischen dem alten Chi-Quadrat und Fisher sehen, um den Anwendungsbereich ein wenig zu erweitern. Es gibt viele Tests für Interaktionen in einer Kontingenztabelle, die ausreichen, um meinen Kopf zum Drehen zu bringen. Ich hoffe, eine Erklärung zu bekommen, welchen …



6
Überprüfen Sie die memorylose Eigenschaft einer Markov-Kette
Ich vermute, dass eine Reihe von beobachteten Sequenzen eine Markov-Kette sind ... X=⎛⎝⎜⎜⎜⎜AB⋮BCA⋮CDA⋮ADC⋮DBA⋮AAD⋮BCA⋮E⎞⎠⎟⎟⎟⎟X=(ACDDBACBAACADA⋮⋮⋮⋮⋮⋮⋮BCADABE)X=\left(\begin{array}{c c c c c c c} A& C& D&D & B & A &C\\ B& A& A&C & A&D &A\\ \vdots&\vdots&\vdots&\vdots&\vdots&\vdots&\vdots\\ B& C& A&D & A & B & E\\ \end{array}\right) Wie kann ich jedoch überprüfen, ob …

2
Wie macht man ein verallgemeinertes lineares Modell mit mehreren abhängigen Variablen in R?
Ich habe sechs abhängige Variablen (Zähldaten) und mehrere unabhängige Variablen. In einer MMR sieht das Skript folgendermaßen aus: my.model <- lm(cbind(DV1,DV2,DV3,DV4,DV5,DV6) ~ IV1 + IV2 + ... + IVn) Da meine Daten jedoch gezählt werden, möchte ich ein verallgemeinertes lineares Modell verwenden und habe Folgendes versucht: my.model <- glm(cbind(DV1,DV2,DV3,DV4,DV5,DV6) ~ …

Durch die Nutzung unserer Website bestätigen Sie, dass Sie unsere Cookie-Richtlinie und Datenschutzrichtlinie gelesen und verstanden haben.
Licensed under cc by-sa 3.0 with attribution required.