Ich passe eine L1-regulierte lineare Regression an einen sehr großen Datensatz an (mit n >> p.). Die Variablen sind im Voraus bekannt, aber die Beobachtungen treffen in kleinen Stücken ein. Ich möchte das Lasso nach jedem Stück fit halten. Ich kann natürlich das gesamte Modell nach jedem neuen Satz von …
Ich entwerfe einen Fragebogen für meine Dissertation. Ich bin dabei, den Fragebogen zu validieren, den ich mit einem Cronbach-Alpha-Test für die Erstmustergruppe erstellt habe. Die Beantwortung des Fragebogens erfolgt auf einer Likert-Skala. Kann jemand weitere Tests vorschlagen, um die Gültigkeit zu testen. Ich bin kein Statistikexperte, daher wäre jede Hilfe …
Ich versuche, einen 20-Punkte-Multiple-Choice-Test zu bewerten. Ich möchte eine Artikelanalyse durchführen, wie sie in diesem Beispiel zu finden ist . Ich möchte also für jede Frage den P-Wert und die Korrelation mit der Gesamtsumme sowie die Verteilung der ausgewählten Optionen. Ich weiß nichts über die verschiedenen statistischen Softwarepakete, aber ich …
Kann jemand über seine Erfahrungen mit einem adaptiven Kernel-Dichteschätzer berichten? (Es gibt viele Synonyme: adaptive | variable | variable-width, KDE | histogram | interpolator ...) Die variable Schätzung der Kerneldichte besagt, dass "wir die Breite des Kernels in verschiedenen Regionen des Probenraums variieren. Es gibt zwei Methoden ..." tatsächlich mehr: …
Ich habe eine logistische Regression mit dem IRLS-Algorithmus programmiert . Ich möchte eine LASSO-Bestrafung anwenden , um automatisch die richtigen Funktionen auszuwählen. Bei jeder Iteration wird Folgendes gelöst: (XTWX)δβ^=XT(y−p)(XTWX)δβ^=XT(y−p)\mathbf{\left(X^TWX\right) \delta\hat\beta=X^T\left(y-p\right)} Sei eine nicht negative reelle Zahl. Ich bestrafe nicht den in The Elements of. Statistisches Lernen . Das Gleiche gilt …
Ich bin gespannt, ob jemand eine bestimmte Referenz (Text oder einen Zeitschriftenartikel) hat, um die in der medizinischen Literatur übliche Praxis der Berechnung der Probengröße mit parametrischen Methoden (dh unter der Annahme einer Normalverteilung und einer bestimmten Varianz der Messungen) zu unterstützen. wenn die Analyse des primären Versuchsergebnisses mit nichtparametrischen …
Problem: Ich parametrisiere Verteilungen zur Verwendung als Prioritäten und Daten in einer Bayes'schen Metaanalyse. Die Daten werden in der Literatur als zusammenfassende Statistiken bereitgestellt, von denen fast ausschließlich angenommen wird, dass sie normal verteilt sind (obwohl keine der Variablen <0 sein kann, einige Verhältnisse sind, andere Massen sind und usw.). …
Kann jemand einige Bücher empfehlen, die als Standardreferenzen für klassische (frequentistische) Statistiken gelten? IE, ziemlich umfassend und auch schon eine Weile da, so dass Tippfehler und Fehler in Formeln eine Chance hatten, überprüft und korrigiert zu werden
Ich arbeite an einem kleinen Textkorpus (200 Millionen), den ich mit einer Clusteranalyse untersuchen möchte. Welche Bücher oder Artikel zu diesem Thema würden Sie empfehlen?
Ich brauche Hilfe, um zu erklären und grundlegende statistische Texte, Dokumente oder andere Verweise zu zitieren, warum es im Allgemeinen falsch ist, die bei der Umfrage gemeldete MOE-Statistik (Margin of Error) zu verwenden, um naiv einen statistischen Gleichstand zu erklären. Ein Beispiel: Kandidat A führt Kandidat B in einer Umfrage …
Meine Frage bezieht sich auf Techniken zum Umgang mit unvollständigen Daten während des Klassifikators / Modelltrainings / Anpassens. In einem Datensatz mit einigen hundert Zeilen, wobei jede Zeile beispielsweise fünf Dimensionen und eine Klassenbezeichnung als letztes Element aufweist, sehen die meisten Datenpunkte folgendermaßen aus: [0,74, 0,39, 0,14, 0,33, 0,34, 0] …
Wann tendieren Sie dazu, ROC-Kurven gegenüber anderen Tests zu verwenden, um die Vorhersagefähigkeit einiger Messungen für ein Ergebnis zu bestimmen? Was macht ROC-Kurven im Umgang mit diskreten Ergebnissen (lebendig / tot, gegenwärtig / abwesend) leistungsfähiger oder weniger leistungsfähig als so etwas wie ein Chi-Quadrat?
Ich möchte einen T-Test mit zwei Stichproben durchführen, um die Differenz zwischen zwei unabhängigen Stichproben zu testen, wobei jede Stichprobe den Annahmen des T-Tests entspricht (wobei angenommen werden kann, dass jede Verteilung unabhängig und identisch als normal mit gleicher Varianz verteilt ist). . Die einzige Komplikation des T-Tests mit zwei …
Ich habe einen Datensatz bestehend aus Elementen aus drei Gruppen, nennen wir sie G1, G2 und G3. Ich habe bestimmte Eigenschaften dieser Elemente analysiert und sie in drei Arten von "Verhalten" T1, T2 und T3 unterteilt (dazu habe ich die Clusteranalyse verwendet). So, jetzt habe ich eine 3 x 3-Kontingenztabelle …
Kennt jemand eine Variation von Fisher's Exact Test, die Gewichte berücksichtigt? Zum Beispiel Stichprobengewichte . Anstelle der üblichen 2x2-Kreuztabelle hat jeder Datenpunkt einen Wert für "Masse" oder "Größe", der den Punkt wiegt. Beispieldaten: A B weight N N 1 N N 3 Y N 1 Y N 2 N Y …
We use cookies and other tracking technologies to improve your browsing experience on our website,
to show you personalized content and targeted ads, to analyze our website traffic,
and to understand where our visitors are coming from.
By continuing, you consent to our use of cookies and other tracking technologies and
affirm you're at least 16 years old or have consent from a parent or guardian.