Statistiken und Big Data

Fragen und Antworten für Personen, die sich für Statistik, maschinelles Lernen, Datenanalyse, Data Mining und Datenvisualisierung interessieren

1
Split-Plot in R.
Ich habe einen Datensatz von Benchmarks und Unterproben in jedem Benchmark. Ich führe diese Benchmarks und ihre Unterproben auf Subjekt-Maschinen aus. Das von den Teilstichproben untersuchte 'Individuum' ist für jede Subjektmaschine gleich, und die Benchmarks sind für jede Subjektmaschine gleich.nnnmmmppp Wie führe ich in dieser Situation eine ANOVA in R …
8 r  anova  split-plot 


2
Ausführen eines R-Skripts zeilenweise
Ich habe gerade herausgefunden, wie man ein R-Skript über die R-Konsole unter Windows ausführt. source("arrrFile.R") Das Problem ist, dass dieser Befehl "still" ausgeführt wird. Wie kann ich die Datei Befehl für Befehl so ausführen, wie ich sie in die Konsole eingeben würde?
8 r 

2
Wie wird der Achsenabschnitt in GLMnet berechnet?
Ich habe die GLMNET-Version des elastischen Netzes für die lineare Regression mit einer anderen Software als R implementiert. Ich habe meine Ergebnisse mit der R-Funktion glmnet im Lasso-Modus für Diabetesdaten verglichen . Die Variablenauswahl ist in Ordnung, wenn der Wert des Parameters (Lambda) variiert wird, aber ich erhalte leicht unterschiedliche …

1
Was bedeutet diese Unschärfe um die Linie in diesem Diagramm?
Ich habe mit ggplot2 mit den folgenden Befehlen herumgespielt, um eine Zeile an meine Daten anzupassen: ggplot(data=datNorm, aes(x=Num, y=Val)) + geom_point() + stat_summary(fun.data = "mean_cl_boot", geom="errorbar", colour="red", width=0.8) + stat_sum_single(median) + stat_sum_single(mean, colour="blue") + geom_smooth(level = 0.95, aes(group=1), method="lm") Die roten Punkte sind Medianwerte, blau sind die Mittelwerte und die …

3
Feature-Konstruktion in R.
Ich frage mich, ob es in R Algorithmen (möglicherweise genetische Algorithmen) für die Merkmalskonstruktion gibt (Ableiten von Prädiktorkandidaten von vorhandenen Prädiktoren). Ich denke an eine Routine zum Testen von Potenzen höherer Ordnung, Wechselwirkungen, Verhältnissen und linearen Kombinationen sowie nichtlinearen Funktionen vorhandener Variablen (sin, cos, atan usw.). Dies kann eine Filter- …

1
Stimmt die maximale Entropieverteilung mit den gegebenen Randverteilungen mit der Produktverteilung der Randverteilungen überein?
Es ist in der Regel viele gemeinsame Verteilungen P.( X.1= x1, X.2= x2, . . . , X.n= xn)P(X1=x1,X2=x2,...,Xn=xn)P(X_1 = x_1, X_2 = x_2, ..., X_n = x_n) in Übereinstimmung mit einer bekannten Satz Randverteilungen .fich( xich) = P.( X.ich= xich)fich(xich)=P.(X.ich=xich)f_i(x_i) = P(X_i = x_i) von diesen gemeinsamen Verteilungen das …

1
Anpassen einer Linie an ein Protokoll-Protokoll-Diagramm
Ich habe einige Daten, mit denen ich herumspiele. Nehmen wir zur Vereinfachung an, die Daten enthalten Informationen zur Anzahl der von einem Blogger verfassten Beiträge im Vergleich zur Anzahl der Personen, die den Blog dieser Person abonniert haben (dies ist nur ein erfundenes Beispiel). Ich möchte ein grobes Modell der …



3
Interpretation des Koeffizienten in einem linearen Regressionsmodell mit kategorialen Variablen
Ich werde meine Beispiele mit R-Aufrufen geben. Zunächst ein einfaches Beispiel einer linearen Regression mit einer abhängigen Variablen 'Lebensdauer' und zwei kontinuierlichen erklärenden Variablen. data.frame(height=runif(4000,160,200))->human.life human.life$weight=runif(4000,50,120) human.life$lifespan=sample(45:90,4000,replace=TRUE) summary(lm(lifespan~1+height+weight,data=human.life)) Call: lm(formula = lifespan ~ 1 + height + weight, data = human.life) Residuals: Min 1Q Median 3Q Max -23.0257 -11.9124 -0.0565 …

2
Was ist ein autoregressives Vektormodell?
Ich möchte dies aus Managementsicht verstehen. Wenn ich zum Beispiel die lineare Regression erklären würde, würde ich sagen, dass sie eine Linie ist, die am besten durch einige Datenpunkte passt, und sie kann verwendet werden, um einen "y" -Wert für einen bestimmten Wert von "x" vorherzusagen. Gibt es eine analoge …

1
Wie nennt man diese dynamische Auswahlstrategie für die Stichprobengröße?
Stellen Sie sich vor, Sie möchten die Komprimierbarkeit eines großen Dokuments sehr schnell beurteilen. Sie können eine Teilsequenz zufällig auswählen und versuchen, sie zu komprimieren. Dies kann als Vorhersage für die Gesamtkomprimierbarkeit des Dokuments dienen. Aber wie groß sollte Ihre Stichprobe sein? Wir haben folgende Strategie entwickelt: Wählen Sie eine …

1
Suche nach Muster von Ereignissen in einer Zeitreihe
Ich habe ein Zeitverlaufsexperiment, das 8 Behandlungsgruppen von 12 Fischen für 24 Stunden mit Beobachtungen in Intervallen von 5 Sekunden folgt. Unter den durchgeführten Messungen ist, wie weit sich jeder Fisch zwischen den Beobachtungen bewegt (in mm). Die 24 Stunden sind in 1 Dunkelperiode und 1 Hellperiode unterteilt. Hier ist …

2
A / B-Tests in Python oder R [geschlossen]
Geschlossen. Diese Frage ist nicht zum Thema . Derzeit werden keine Antworten akzeptiert. Möchten Sie diese Frage verbessern? Aktualisieren Sie die Frage so dass es beim Thema für Kreuz Validated. Geschlossen vor 7 Monaten . A / B-Tests: http://20bits.com/articles/statistical-analysis-and-ab-testing/ http://elem.com/~btilly/effective-ab-testing/ Ich bin mit A / B-Tests nicht allzu vertraut, habe …
8 r  python  ab-test 

Durch die Nutzung unserer Website bestätigen Sie, dass Sie unsere Cookie-Richtlinie und Datenschutzrichtlinie gelesen und verstanden haben.
Licensed under cc by-sa 3.0 with attribution required.