Statistiken und Big Data

Fragen und Antworten für Personen, die sich für Statistik, maschinelles Lernen, Datenanalyse, Data Mining und Datenvisualisierung interessieren

1
Wie mache ich ein alterspyramidenähnliches Grundstück in R?
Verschlossen . Diese Frage und ihre Antworten sind gesperrt, da die Frage nicht zum Thema gehört, aber von historischer Bedeutung ist. Derzeit werden keine neuen Antworten oder Interaktionen akzeptiert. Die Alterspyramide sieht so aus: Ich möchte etwas Ähnliches machen, nämlich 2 Balkendiagramme (keine Histogramme) mit den gleichen Kategorien, die vertikal …

2
Verwalten von Fehlern mit GPS-Routen (theoretischer Rahmen?)
Ich suche nach einem geeigneten theoretischen Rahmen oder Fachgebiet, um zu verstehen, wie ich mit den Fehlern des GPS-Systems umgehen kann - insbesondere beim Umgang mit Routen. Grundsätzlich suche ich nach den Anforderungen an die Daten und die zu verwendenden Algorithmen, um die Länge eines Trails bestimmen zu können. Die …
14 error  sampling 



2
Warum verbessert sich die OOB-Schätzung für zufällige Gesamtstrukturen, wenn die Anzahl der ausgewählten Features verringert wird?
Ich wende einen zufälligen Gesamtstrukturalgorithmus als Klassifikator auf ein Microarray-Dataset an, das in zwei bekannte Gruppen mit Tausenden von Features aufgeteilt ist. Nach dem ersten Start schaue ich mir die Wichtigkeit der Features an und starte den Tree-Algorithmus erneut mit den wichtigsten Features 5, 10 und 20. Ich finde, dass …

3
Können CART-Modelle robust gemacht werden?
Ein Kollege in meinem Büro sagte mir heute: "Baummodelle sind nicht gut, weil sie von extremen Beobachtungen erfasst werden." Eine Suche hier ergab diesen Thread , der im Grunde den Anspruch unterstützt. Was mich zu der Frage führt: In welcher Situation kann ein CART-Modell robust sein und wie wird dies …


3
R-Paket für die logistische Regression mit fester Wirkung
Ich suche ein RPaket zur Schätzung der Koeffizienten von Logit-Modellen mit individuellem Fixeffekt (individueller Schnittpunkt) unter Verwendung des Chamberlain-Schätzers von 1980. Es wird oft als Chamberlains Logit-Schätzer mit festem Effekt bezeichnet. Es ist ein klassischer Schätzer beim Umgang mit binären Ergebnispaneldaten (zumindest in der Ökonometrie), aber ich finde im CRAN …

2
Was würde ein Konfidenzintervall um einen vorhergesagten Wert aus einem Mischeffektmodell bedeuten?
Ich habe diese Seite angesehenund bemerkte die Methoden für Konfidenzintervalle für lme und lmer in R. Für diejenigen, die R nicht kennen, sind dies Funktionen zum Erzeugen gemischter Effekte oder mehrstufiger Modelle. Wenn ich feste Effekte in so etwas wie einem Entwurf mit wiederholten Messungen habe, was würde ein Konfidenzintervall …



12
Statistik Konferenzen?
Was sind die wichtigsten jährlichen Statistikkonferenzen? Regeln: Eine Konferenz pro Antwort Fügen Sie einen Link zur Konferenz hinzu

9
Visualisierungssoftware für Clustering
Verschlossen . Diese Frage und ihre Antworten sind gesperrt, da die Frage nicht zum Thema gehört, aber von historischer Bedeutung ist. Derzeit werden keine neuen Antworten oder Interaktionen akzeptiert. Ich möchte ~ 22000 Punkte gruppieren. Viele Clustering-Algorithmen funktionieren besser mit besseren Anfangsschätzungen. Welche Tools können mir einen guten Eindruck von …



Durch die Nutzung unserer Website bestätigen Sie, dass Sie unsere Cookie-Richtlinie und Datenschutzrichtlinie gelesen und verstanden haben.
Licensed under cc by-sa 3.0 with attribution required.