Kontext: Ich habe zwei Datensätze aus demselben Fragebogen, die über zwei Jahre laufen. Jede Frage wird anhand einer 5-Likert-Skala gemessen. Q1: Codierungsschema Im Moment habe ich meine Antworten in einem Intervall von [0, 1] codiert, wobei 0 "negativste Antwort", 1 "positivste Antwort" und andere gleichmäßig verteilte Antworten bedeuten. Was ist …
Ich habe zwei Datensätze aus genomweiten Assoziationsstudien. Die einzigen verfügbaren Informationen sind die ungeraden Verhältnisse und ihre Konfidenzintervalle (95%) für jedes genotypisierte SNP. Ich möchte ein Walddiagramm erstellen, in dem diese beiden Quotenverhältnisse verglichen werden, aber ich kann die kombinierten Konfidenzintervalle nicht berechnen, um die Zusammenfassungseffekte zu visualisieren. Ich habe …
Eine englische Fußballmannschaft spielt eine Reihe von Spielen gegen verschiedene Gegner mit unterschiedlichen Fähigkeiten. Ein Buchmacher bietet für jedes Spiel eine Quote an, ob es sich um einen Heimsieg, einen Auswärtssieg oder ein Unentschieden handelt. In der Mitte der Saison hat die Mannschaft Spiele bestritten und davon gezogen, was mehr …
Gesperrt . Diese Frage und ihre Antworten sind gesperrt, da die Frage nicht zum Thema gehört, aber historische Bedeutung hat. Derzeit werden keine neuen Antworten oder Interaktionen akzeptiert. Ich gehe davon aus, dass R dies eingebaut hat. Wie verweise ich darauf?
Ich versuche, die Matrixnotation zu verstehen und mit Vektoren und Matrizen zu arbeiten. Im Moment möchte ich verstehen, wie der Vektor der Koeffizientenschätzungen in der multiplen Regression berechnet wird.β^β^\hat{\beta} Die Grundgleichung scheint zu sein ddβ(y−Xβ)′(y−Xβ)=0.ddβ(y−Xβ)′(y−Xβ)=0. \frac{d}{d\boldsymbol{\beta}} (\boldsymbol{y}-\boldsymbol{X\beta})'(\boldsymbol{y}-\boldsymbol{X\beta}) = 0 \>. Wie würde ich hier nach einem Vektor ββ\beta suchen? Edit …
Ich habe ein Skript geschrieben, das die Daten mit dem testet wilcox.test, aber als ich die Ergebnisse erhielt, waren alle p-Werte gleich 1. Ich habe auf einigen Websites gelesen, dass Sie vor dem Testen der Daten Jitter verwenden könnten (um Verbindungen zu vermeiden, wie sie sagten). Ich habe das getan …
Mein Datensatz umfasst entweder die Gesamtmortalität oder das Überleben eines Organismus an drei Standorttypen: Inshore, Midchannel und Offshore. Die Zahlen in der folgenden Tabelle geben die Anzahl der Standorte an. 100% Mortality 100% Survival Inshore 30 31 Midchannel 10 20 Offshore 1 10 Ich würde gerne wissen, ob die Anzahl …
Ich habe zwei logistische Regressionsmodelle in R erstellt mit glm(). Beide verwenden dieselben Variablen, wurden jedoch mit unterschiedlichen Teilmengen einer Matrix erstellt. Gibt es eine einfache Möglichkeit, ein Durchschnittsmodell zu erhalten, das die Mittelwerte der Koeffizienten angibt, und dieses dann mit der Funktion Predict () zu verwenden? [Entschuldigung, wenn diese …
Stellen Sie sich ein Experiment mit mehreren menschlichen Teilnehmern vor, die jeweils mehrfach unter zwei Bedingungen gemessen wurden. Ein Modell mit gemischten Effekten kann (unter Verwendung der lme4- Syntax) wie folgt formuliert werden : fit = lmer( formula = measure ~ (1|participant) + condition ) Angenommen, ich möchte Bootstrap-Konfidenzintervalle für …
Ich möchte Korrelationen für eine Reihe von Messungen durchführen, bei denen Likert-Skalen verwendet wurden. Betrachtet man die Streudiagramme, so scheint es, dass die Annahmen der Linearität und Homoskedastizität verletzt wurden. Angesichts der Tatsache, dass es offenbar eine Debatte über die Bewertung der Ordnungsstufe gibt, die sich der Skalierung der Intervallstufe …
Wie berechnet man die diskrete Intervallabdeckung? Was ich kann: Wenn ich ein kontinuierliches Modell hätte, könnte ich für jeden meiner vorhergesagten Werte ein 95% -Konfidenzintervall definieren und dann sehen, wie oft die tatsächlichen Werte innerhalb des Konfidenzintervalls liegen. Ich könnte feststellen, dass mein Konfidenzintervall von 95% in nur 88% der …
Ich möchte eine Quadratzählungsanalyse für mehrere Punktprozesse (oder einen markierten Punktprozess) durchführen, um dann einige Techniken zur Reduzierung der Dimensionalität anzuwenden. Die Marken sind nicht identisch verteilt, dh einige Marken erscheinen ziemlich oft und andere sind ziemlich selten. Daher kann ich meinen 2D-Raum nicht einfach in ein reguläres Raster unterteilen, …
Ich suche nach einer soliden Referenz (oder Referenzen) zu numerischen Optimierungstechniken, die sich an Statistiker richten, dh diese Methoden würden auf einige Standard-Inferenzprobleme angewendet (z. B. MAP / MLE in gängigen Modellen). Dinge wie Gradientenabstieg (gerade und stochastisch), EM und seine Ausgründungen / Verallgemeinerungen, simuliertes Tempern usw. Ich hoffe, dass …
Ich habe einen Datensatz mit Ereignissen, die im selben Zeitraum aufgetreten sind. Jedes Ereignis hat einen Typ (es gibt nur wenige verschiedene Typen, weniger als zehn) und einen Ort, der als 2D-Punkt dargestellt wird. Ich möchte prüfen, ob eine Korrelation zwischen Ereignistypen oder zwischen Typ und Ort besteht. Beispielsweise treten …
Ist es möglich, die Kernel-Hauptkomponentenanalyse (kPCA) für die latente semantische Indizierung (LSI) auf dieselbe Weise wie die PCA zu verwenden? Ich führe LSI in R mit der prcompPCA-Funktion durch und extrahiere die Merkmale mit den höchsten Belastungen aus den ersten Komponenten. Dadurch erhalte ich die Funktionen, die die Komponente am …
We use cookies and other tracking technologies to improve your browsing experience on our website,
to show you personalized content and targeted ads, to analyze our website traffic,
and to understand where our visitors are coming from.
By continuing, you consent to our use of cookies and other tracking technologies and
affirm you're at least 16 years old or have consent from a parent or guardian.