Verwenden Sie dieses Tag für jede * themenbezogene * Frage, bei der (a) "R" entweder als kritischer Teil der Frage oder als erwartete Antwort enthält, und (b) nicht * nur * die Verwendung von "R" betrifft.
Ich habe Daten für Kraftfahrzeugunfälle nach Tageszeit. Wie zu erwarten, sind sie mitten am Tag hoch und erreichen zur Hauptverkehrszeit ihren Höhepunkt. Die Standard-geom_density von ggplot2 glättet es gut Eine Teilmenge der Daten für Unfälle im Zusammenhang mit Alkohol am Steuer ist an beiden Enden des Tages (abends und am …
Angenommen, wir haben die folgenden Daten: set.seed(123) data <- data.frame(x = c(rnorm(50, 1, 1), rnorm(50, 5, 2)), y = c(rep('A', 50), rep('B', 50))) Was das folgende Boxplot ( boxplot(data$x ~ data$y)) ergibt : Angenommen, ich möchte testen, ob die beiden Stichproben dieselben Standortparameter haben (Median und / oder Mittelwert). In …
Ich bin kein Experte, also vergib mir, wenn ein Teil der Terminologie etwas ungeschickt ist. Gerne stellen wir Ihnen bei Bedarf weitere Informationen zur Verfügung. Ich habe zwei Vektoren mit 50 gepaarten numerischen Werten in R. Ich möchte einen zweiseitigen Randomisierungs- oder Permutationstest durchführen, um festzustellen, ob ihre Unterschiede zufällig …
Ich möchte zufällige Daten aus einer eingeschränkten Normalverteilung mit R generieren. Zum Beispiel möchte ich vielleicht eine Variable aus einer Normalverteilung mit simulieren mean=3, sd= 2und alle Werte größer als 5 werden aus derselben Normalverteilung neu abgetastet. Für die allgemeine Funktion könnte ich also Folgendes tun. rnorm(n=100, mean=3, sd=2) Ich …
Kennt jemand eine Funktion oder ein R-Paket, das mir helfen kann, z-Werte in Perzentil-Werte umzuwandeln? Das endgültige Ziel besteht darin, eine Gruppe von Befragten anhand der Höhe ihrer Z-Werte in vier Kategorien einzuteilen oder einzustufen (20% niedrigste Werte, 30%, 30%, 20% höchste Werte). Irgendwelche Ideen? Vielen Dank im Voraus!
Ich frage mich, ob es eine gute Möglichkeit gibt, das Clustering-Kriterium basierend auf der BIC-Formel für eine k-Mittelwert-Ausgabe in R zu berechnen. Ich bin etwas verwirrt darüber, wie ich diesen BIC berechnen soll, damit ich ihn mit anderen Clustering-Modellen vergleichen kann. Derzeit verwende ich die Implementierung des Statistikpakets von k-means.
Ich erstelle ein Skript zum Erstellen von Bootstrap-Beispielen aus dem catsDataset (aus dem -MASS-Paket). Nach dem Lehrbuch von Davidson und Hinkley [1] führte ich eine einfache lineare Regression durch und übernahm ein grundlegendes nichtparametrisches Verfahren für das Bootstrapping von iid-Beobachtungen, nämlich das Resampling von Paaren . Das Originalmuster hat folgende …
Ich habe eine große Anzahl von Prädiktoren (mehr als 43.000) zur Vorhersage einer abhängigen Variablen, die 2 Werte annehmen kann (0 oder 1). Die Anzahl der Beobachtungen beträgt mehr als 45.000. Die meisten Prädiktoren sind Unigramme, Bigramme und Trigramme von Wörtern, daher besteht zwischen ihnen ein hohes Maß an Kollinearität. …
Mit plot.rqdem quantregPaket in R können wir die Koeffizientenschätzungsverteilung darstellen und so etwas erhalten: Was sind die gepunkteten roten Linien? Ausgiebiges Googeln hat ergeben, dass die mittlere der Durchschnitt aller 99 Schätzungen ist, aber immer noch nichts über die gepunktete rote Linie weiß.
Ich möchte 95% -Konfidenzintervalle für Zentroide erhalten, basierend auf der Gower-Ähnlichkeit zwischen einigen mulivariaten Proben (Community-Daten von Sedimentkernen). Bisher habe ich das vegan{}Paket in R verwendet, um eine modifizierte Gower-Ähnlichkeit zwischen Kernen zu erhalten (basierend auf Anderson 2006; jetzt in R als Teil von enthalten vegdist()). Weiß jemand, wie ich …
Ich habe einen medizinischen Datensatz mit ca. 200 Variablen. Eine der Variablen ist ein Bio-Marker (Konzentration eines bestimmten Enzyms). Die Verteilung ist recht schief und das Problem ist, dass Werte über einem bestimmten Level auf diesem Level zensiert / abgeschnitten werden. Während der Mittelwert der Variablen bei 10 liegt, werden …
Ich habe mich gefragt, ob jemand Erfahrung mit der Mäusefunktion hat, wie in Mäusen beschrieben: Multivariate Imputation durch verkettete Gleichungen in R (JSS 2011 45 (3))? Ich habe einen Datensatz mit einer Reihe von Variablen, von denen jede einen unterschiedlichen Grad an fehlenden Daten aufweist. Meine Hauptfrage lautet: Angenommen, ich …
Wir haben einen Datensatz mit zwei Kovariaten und einer kategorialen Gruppierungsvariablen und möchten wissen, ob es signifikante Unterschiede zwischen der Steigung oder dem Achsenabschnitt zwischen den Kovariaten gibt, die den verschiedenen Gruppierungsvariablen zugeordnet sind. Wir haben anova () und lm () verwendet, um die Anpassungen von drei verschiedenen Modellen zu …
Angenommen, ich generiere die Wahrscheinlichkeit eines Ergebnisses basierend auf einem bestimmten Faktor und zeichne die Kurve dieses Ergebnisses. Gibt es eine Möglichkeit, die Gleichung für diese Kurve aus R zu extrahieren? > mod = glm(winner~our_bid, data=mydat, family=binomial(link="logit")) > summary(mod) Call: glm(formula = winner ~ our_bid, family = binomial(link = "logit"), …
We use cookies and other tracking technologies to improve your browsing experience on our website,
to show you personalized content and targeted ads, to analyze our website traffic,
and to understand where our visitors are coming from.
By continuing, you consent to our use of cookies and other tracking technologies and
affirm you're at least 16 years old or have consent from a parent or guardian.