Statistiken und Big Data

Fragen und Antworten für Personen, die sich für Statistik, maschinelles Lernen, Datenanalyse, Data Mining und Datenvisualisierung interessieren

2
Wie wählt man Zufalls- und Festeffektstruktur in linearen gemischten Modellen?
Betrachten Sie die folgenden Daten aus einer wechselseitigen Betrachtung innerhalb des Probandendesigns: df <- "http://personality-project.org/r/datasets/R.appendix4.data" df <- read.table(df,header=T) head(df) Observation Subject Task Valence Recall 1 1 Jim Free Neg 8 2 2 Jim Free Neu 9 3 3 Jim Free Pos 5 4 4 Jim Cued Neg 7 5 5 …




2
Was bedeutet der Name "Logistische Regression"?
Von hier aus überprüfe ich eine Implementierung von Logistic Regression . Nachdem ich diesen Artikel gelesen habe, scheint es wichtig zu sein, die besten Koeffizienten für die Bestimmung der Sigmoidfunktion zu finden. Ich frage mich nur, warum diese Methode "Logistische Regression" heißt. Hängt es mit der logarithmischen Funktion zusammen? Vielleicht …



1
Wie kann ich der Position von geom_point in ggplot2 ausweichen?
Verschlossen . Diese Frage und ihre Antworten sind gesperrt, da die Frage nicht zum Thema gehört, aber von historischer Bedeutung ist. Derzeit werden keine neuen Antworten oder Interaktionen akzeptiert. Ich verwende ggplot2 in R, um Diagramme wie die folgenden zu erstellen: Die Fehlerbalken überlappen sich und sehen sehr unordentlich aus. …

4
Gutes Datenbeispiel für Kovariaten, die von Behandlungen betroffen sind
Ich habe mir viele R-Datensätze, Postings in DASL und anderswo angesehen und finde nicht sehr viele gute Beispiele für interessante Datensätze, die die Analyse der Kovarianz für experimentelle Daten veranschaulichen. Es gibt zahlreiche "Spielzeug" -Datensätze mit erfundenen Daten in statistischen Lehrbüchern. Ich hätte gerne ein Beispiel, wo: Die Daten sind …


1
Wenn die Daten vor PCA nicht normalisiert werden, wird das Varianzverhältnis besser erklärt
Ich normalisierte meinen Datensatz und führte dann eine 3-Komponenten-PCA durch, um kleine erklärte Varianzverhältnisse ([0,50, 0,1, 0,05]) zu erhalten. Wenn ich meinen Datensatz nicht normalisierte, sondern aufhellte und dann eine 3-Komponenten-PCA durchführte, erhielt ich hohe erklärte Varianzverhältnisse ([0,86, 0,06, 0,01]). Da ich so viele Daten wie möglich in 3 Komponenten …
19 pca 



2
Ist ein gewichtetes
Ich habe ein robustes lineares Modell Rmit MM-Gewichten unter Verwendung des rlm()im MASS-Paket enthaltenen Modells geschätzt . `R`` liefert keinen Wert für das Modell, aber ich hätte gerne einen, wenn es sich um eine aussagekräftige Größe handelt. Ich bin auch daran interessiert zu wissen, ob es eine Bedeutung hat, einen …

1
Berechnen und zeichnen Sie die LDA-Entscheidungsgrenze
Ich habe eine grafische Darstellung der linearen Diskriminanzanalyse (LDA) mit Entscheidungsgrenzen aus den Elementen des statistischen Lernens gesehen : Ich verstehe, dass Daten auf einen unterdimensionalen Unterraum projiziert werden. Ich möchte jedoch wissen, wie wir die Entscheidungsgrenzen in der ursprünglichen Dimension erhalten, so dass ich die Entscheidungsgrenzen auf einen unterdimensionalen …

Durch die Nutzung unserer Website bestätigen Sie, dass Sie unsere Cookie-Richtlinie und Datenschutzrichtlinie gelesen und verstanden haben.
Licensed under cc by-sa 3.0 with attribution required.