Statistiken und Big Data

Fragen und Antworten für Personen, die sich für Statistik, maschinelles Lernen, Datenanalyse, Data Mining und Datenvisualisierung interessieren

2
Fehler beim Ausführen von glmnet in Multinomial [geschlossen]
Geschlossen. Diese Frage ist nicht zum Thema . Derzeit werden keine Antworten akzeptiert. Möchten Sie diese Frage verbessern? Aktualisieren Sie die Frage so dass es beim Thema für Kreuz Validated. Geschlossen vor 8 Monaten . Das in dieser Frage erwähnte Problem wurde in Version 1.7.3 des R-Pakets glmnet behoben. Ich …
9 r  multinomial  glmnet 

1
Wie kann man die Gewinner einer regionalen Wissenschaftsmesse fair ermitteln?
Ich brauche Hilfe, um herauszufinden, wie die Gewinner unserer Wissenschaftsmesse richtig berechnet werden können. Ich möchte nicht, dass meine Unkenntnis von Statistik und Mathematik die Gewinnchancen eines Kindes beeinträchtigt. (viele Stipendien- und Aufstiegsvorteile stehen auf dem Spiel). Vielen Dank im Voraus für Ihre Hilfe. Zunächst ein kleiner Hintergrund darüber, wie …

1
Unterschiedliches Vorhersageplot von Survival Coxph und RMS Cph
Ich habe meine eigene, leicht verbesserte Version des Termplots erstellt, die ich in diesem Beispiel verwende. Sie finden sie hier . Ich habe zuvor auf SO gepostet, aber je mehr ich darüber nachdenke, desto mehr hängt dies wahrscheinlich mit der Interpretation des Cox Proportional Hazards-Modells zusammen als mit der tatsächlichen …
9 r  survival  cox-model 

1
Wann wählen Sie PCA vs. LSA / LSI
Frage: Gibt es allgemeine Richtlinien in Bezug auf die Eingabedateneigenschaften, anhand derer zwischen der Anwendung von PCA und LSA / LSI entschieden werden kann? Kurze Zusammenfassung von PCA vs. LSA / LSI: Die Hauptkomponentenanalyse (PCA) und die latente semantische Analyse (LSA) oder die latente semantische Indexierung (LSI) sind insofern ähnlich, …


1
Wie definiere ich, was eine „Probe“ ist?
Wenn ich Ihnen drei Zahlen gebe, die unabhängig und identisch aus einer Standardnormalverteilung stammen, habe ich Ihnen dann drei oder eine Stichprobe gegeben? Wenn die Antwort ein Beispiel ist, gibt es dann einen kurzen Namen für das, wovon ich Ihnen drei gegeben habe?

1
Beratung für Doktoranden in Statistik
Ich habe in diesem Jahr meine Promotion in Statistik begonnen und suche nach Ihren Best Practices, Ratschlägen und (Meta-Ratschlägen), wie Sie wachsen und ein guter akademischer Forscher in den Bereichen Statistik / ML werden können. Allgemeine Gedanken und Links sind willkommen, aber um den Ball ins Rollen zu bringen, finden …
9 careers  phd  academia 

2
Wie passt man eine Regression wie
Ich habe einige Zeitreihendaten, bei denen die Messgröße diskrete positive ganze Zahlen (Zählungen) sind. Ich möchte testen, ob es im Laufe der Zeit einen Aufwärtstrend gibt (oder nicht). Die unabhängige Variable (x) liegt im Bereich von 0 bis 500 und die abhängige Variable (y) liegt im Bereich von 0 bis …
9 r  regression  python 



1
Wie kombiniere ich die Prognosen, wenn die Antwortvariable in Prognosemodellen unterschiedlich war?
Einführung In der Prognosekombination basiert eine der beliebtesten Lösungen auf der Anwendung einiger Informationskriterien. Wenn man zum Beispiel das für das Modell geschätzte Akaike-Kriterium , könnte man die Differenzen von von und dann könnte RP_j = e ^ {(AIC ^ * - AIC_j) / 2} interpretiert werden als die relative …

1
Verteilung des Kehrwerts des Regressionskoeffizienten
Angenommen, wir haben ein lineares Modell , das alle Standardannahmen für die Regression (Gauss-Markov) erfüllt. Wir interessieren uns für .yi=β0+β1xi+ϵiyi=β0+β1xi+ϵiy_i = \beta_0 + \beta_1 x_i + \epsilon_iθ=1/β1θ=1/β1\theta = 1/\beta_1 Frage 1: Welche Annahmen sind notwendig, damit die Verteilung von genau definiert ist? wäre wichtig --- irgendwelche anderen?θ^θ^\hat{\theta}β1≠0β1≠0\beta_1 \neq 0 Frage …


3
Was könnte eine klare, praktische Definition für eine „Familie von Hypothesen“ sein (in Bezug auf die familienbezogene Fehlerrate)?
Bei dem Versuch zu bewerten, was eine Hypothesenfamilie innerhalb eines Experiments / Projekts / einer Analyse ausmacht, habe ich festgestellt, dass "ähnliche Ziele" und "ähnliche Inhalte" als Richtlinien für die Abgrenzung von Familien angegeben sind, aber diese lassen ziemlich viel Interpretationsspielraum ( um es vorsichtig auszudrücken). Es scheint klar zu …

2
Kann ich einer Regression vertrauen, wenn Variablen automatisch korreliert werden?
Beide Variablen (abhängig und unabhängig) zeigen Autokorrelationseffekte. Die Daten sind Zeitreihen und stationär Wenn ich die Regressionsreste ausführe, scheinen sie nicht korreliert zu sein. Meine Durbin-Watson-Statistik ist größer als der obere kritische Wert, daher gibt es Hinweise darauf, dass Fehlerterme nicht positiv korreliert sind. Auch wenn ich ACF auf Fehler …

Durch die Nutzung unserer Website bestätigen Sie, dass Sie unsere Cookie-Richtlinie und Datenschutzrichtlinie gelesen und verstanden haben.
Licensed under cc by-sa 3.0 with attribution required.