Statistiken und Big Data

Fragen und Antworten für Personen, die sich für Statistik, maschinelles Lernen, Datenanalyse, Data Mining und Datenvisualisierung interessieren


5
Wie spezifiziere ich eine logarithmische Normalverteilung im Argument der glm-Familie in R?
Einfache Frage: Wie spezifiziere ich eine logarithmische Normalverteilung im Argument der GLM-Familie in R? Ich konnte nicht finden, wie dies erreicht werden kann. Warum ist lognormal (oder exponentiell) keine Option im Familienargument? Irgendwo in den R-Archiven habe ich gelesen, dass man einfach den Log-Link für die Familie verwenden muss, die …

3
Passender multivariater, natürlicher kubischer Spline
Anmerkung: keine richtigen Antworten nach einem Monat habe ich zu reposted SO Hintergrund Ich habe ein Modell, , wobeifffY=f(X)Y=f(X)Y=f(\textbf{X}) XX\textbf{X} ist eine Matrix von Abtastwerten aus Parametern und ist der Vektor von Modellausgaben.m Y n × 1n×mn×mn \times mmmmYYYn×1n×1n \times 1 fff ist rechenintensiv, daher möchte ich mit einem multivariaten …



2
Anteil der erklärten Varianz in einem Mixed-Effects-Modell
Ich weiß nicht, ob dies vorher gefragt wurde, aber ich habe nichts darüber gefunden. Meine Frage ist, ob jemand eine gute Referenz liefern kann, um zu lernen, wie man den Varianzanteil erhält, der durch jeden der festen und zufälligen Faktoren in einem Modell mit gemischten Effekten erklärt wird.

1
LASSO Annahmen
In einem LASSO-Regressionsszenario, in dem y= Xβ+ ϵy=Xβ+ϵy= X \beta + \epsilon , und die LASSO-Schätzungen sind durch das folgende Optimierungsproblem gegeben Mindestβ| | y- Xβ| | +τ| | β| |1minβ||y−Xβ||+τ||β||1 \min_\beta ||y - X \beta|| + \tau||\beta||_1 Gibt es irgendwelche Verteilungsannahmen bezüglich des ϵϵ\epsilon ? In einem OLS-Szenario würde …

2
Wie interpretiere ich Exp (B) in der Cox-Regression?
Ich bin ein Medizinstudent, der versucht, Statistiken zu verstehen (!) - seien Sie also bitte vorsichtig! ;) Ich schreibe einen Aufsatz, der eine ganze Menge statistischer Analysen enthält, einschließlich Überlebensanalysen (Kaplan-Meier, Log-Rank und Cox-Regression). Ich führte eine Cox-Regression meiner Daten durch, um herauszufinden, ob ich einen signifikanten Unterschied zwischen den …


4
Welche Vor- und Nachteile hat die Verwendung der Logrank-Methode im Vergleich zur Mantel-Haenszel-Methode für die Berechnung des Hazard Ratio in der Überlebensanalyse?
Eine Möglichkeit, den Vergleich zweier Überlebenskurven zusammenzufassen, ist die Berechnung der Hazard Ratio (HR). Es gibt (mindestens) zwei Methoden, um diesen Wert zu berechnen. Logrank-Methode. Berechnen Sie im Rahmen der Kaplan-Meier-Berechnungen die Anzahl der beobachteten Ereignisse (normalerweise Todesfälle) in jeder Gruppe ( und ) und die Anzahl der erwarteten Ereignisse …
17 survival  hazard 




3
Bayesianische Aktualisierung mit neuen Daten
Wie berechnen wir einen Posterior mit einem vorherigen N ~ (a, b), nachdem wir n Datenpunkte beobachtet haben? Ich gehe davon aus, dass wir den Stichprobenmittelwert und die Varianz der Datenpunkte berechnen und eine Art Berechnung durchführen müssen, die den hinteren mit dem vorherigen kombiniert, aber ich bin nicht ganz …


Durch die Nutzung unserer Website bestätigen Sie, dass Sie unsere Cookie-Richtlinie und Datenschutzrichtlinie gelesen und verstanden haben.
Licensed under cc by-sa 3.0 with attribution required.