Statistiken und Big Data

Fragen und Antworten für Personen, die sich für Statistik, maschinelles Lernen, Datenanalyse, Data Mining und Datenvisualisierung interessieren

1
Blockieren Sie den Bootstrap für einen Anfänger
Um meine Frage in einen Zusammenhang zu bringen, ich bin Physiker, aber nur begrenzt mit Statistiken vertraut, und was ich darüber gelernt habe, war vor über 30 Jahren. Ich versuche, etwas über Block-Bootstrapping zu lernen, da diese Technik möglicherweise zur Lösung eines Problems geeignet ist, an dem ich arbeite. Ich …



2
Ähnlichkeiten und Unterschiede zwischen dem IRT-Modell und dem logistischen Regressionsmodell
Trotz der grundlegenden Ähnlichkeiten wie bei beiden Modellen ist die Erfolgswahrscheinlichkeit eher als die direkte Modellierung der Antwortvariablen; Ich glaube, dass es zuverlässigere Antworten gibt, die auf die Unterschiede und Ähnlichkeiten zwischen diesen Modellen hinweisen. Ein Unterschied besteht darin, dass in der Logistik unterschiedliche Typen und unterschiedliche Anzahlen unabhängiger Variablen …

2
Vollständige Statistik für
Ich würde gerne wissen, ob die Statistik vollständig ist für in einer -Einstellung. σ2N(μ,σ2)T.( X.1, … , X.n) = ∑ni = 1( X.ich- X.¯n)2n - 1T(X1,…,Xn)=∑i=1n(Xi−X¯n)2n−1T(X_1,\ldots,X_n)=\frac{\sum_{i=1}^n (X_i-\bar{X}_n)^2}{n-1}σ2σ2\sigma^2N.( μ , σ2)N(μ,σ2)N(\mu,\sigma^2) Hängt dies davon ab, ob zuvor bekannt ist oder nicht? Wenn für vollständig ist , dann ist es von Lehmann-Scheffé …

1
Erwarteter Wert des Verhältnisses korrelierter Zufallsvariablen?
Für unabhängige Zufallsvariablen und gibt es einen Ausdruck in geschlossener Form fürαα\alphaββ\beta E[αα2+β2√]E[αα2+β2]\mathbb E \left[ \frac{\alpha}{\sqrt{\alpha^2 + \beta^2}} \right] in Bezug auf die erwarteten Werte und Varianzen von und ? Wenn nicht, gibt es eine gute Untergrenze für diese Erwartung?βαα\alphaββ\beta Update: Ich kann auch erwähnen, dass und . Ich kann …

1
Warum ist die Grenzwahrscheinlichkeit schwer / schwer abzuschätzen?
Ich habe hier eine allgemein grundlegende Frage zu stellen, die mich seit einiger Zeit beunruhigt. Während des größten Teils meiner Lektüre der Bayes'schen Statistik wurde sachlich festgestellt, dass die Grenzwahrscheinlichkeit oft unlösbar oder schwer abzuschätzen ist. Warum? Zu den häufig genannten Gründen gehören Aussagen über die hochdimensionale Natur des zu …

1
bezüglich des Ausgabeformats für die semantische Segmentierung
Beim Lesen der semantischen Segmentierungspapiere sowie der entsprechenden Implementierungen stellte ich fest, dass einige Ansätze Softmax verwenden, während andere Sigmoid für die Beschriftung auf Pixelebene verwenden. In Bezug auf U-Net-Papier ist die Ausgabe beispielsweise eine Feature-Map mit zwei Kanälen. Ich habe einige Implementierungen mit Softmax über diese beiden Kanalausgänge gesehen. …

2
Ist Random Forest eine gute Option für die Klassifizierung unausgeglichener Daten? [geschlossen]
Geschlossen . Diese Frage muss fokussierter sein . Derzeit werden keine Antworten akzeptiert. Möchten Sie diese Frage verbessern? Aktualisieren Sie die Frage so, dass sie sich nur auf ein Problem konzentriert, indem Sie diesen Beitrag bearbeiten . Geschlossen vor 3 Jahren . Kann die zufällige Gesamtstruktur "als Algorithmus" trotz der …


1
Modellmittelungsansatz - Mittelungskoeffizientenschätzungen im Vergleich zu Modellvorhersagen?
Ich habe eine grundlegende Frage zu Ansätzen zur Modellmittelung unter Verwendung von IT-Kriterien zur Gewichtung von Modellen innerhalb eines Kandidatensatzes. Die meisten Quellen, die ich zur Modellmittelung gelesen habe, befürworten die Mittelung der Parameterkoeffizientenschätzungen auf der Grundlage der Modellgewichte (entweder unter Verwendung eines "natürlichen Durchschnitts" oder einer "Null-Durchschnitt" -Methode). Ich …

2
Bonferroni Korrektur & maschinelles Lernen
In psychologischen Studien habe ich gelernt, dass wir die Bonferroni-Methode verwenden sollten, um das Signifikanzniveau anzupassen, wenn wir mehrere Hypothesen an einem einzigen Datensatz testen. Derzeit arbeite ich mit Methoden des maschinellen Lernens wie Support Vector Machines oder Random Forest zur Klassifizierung. Hier habe ich einen einzelnen Datensatz, der bei …


3
Wie wird der Generator in einem GAN trainiert?
Das Papier über GANs besagt, dass der Diskriminator den folgenden Gradienten zum Trainieren verwendet: ∇θd1m∑i = 1m[ logD ( x( i )) +log( 1 - D ( G ( z( i )) ) ) ]∇θd1m∑i=1m[log⁡D(x(i))+log⁡(1−D(G(z(i))))]\nabla _{\theta_d} \frac{1}{m}\sum^{m}_{i=1} [\log{D(x^{(i)})} + \log{(1-D(G(z^{(i)})))}] Die Werte werden abgetastet, durch den Generator geleitet, um Datenabtastwerte …

2
Endlicher ter Moment für einen Zufallsvektor
Wenn , wo die Unterstützung von ist . Also ist . Dann nehme ich an, hat endliche Momente. Wenn , weiß ich, dass dies wobei die zugehörige Dichte von . Was die mathematische Äquivalent davon hat endliche Momente , wenn ?X∼FX∼FX \sim FXXXRpRp\mathbb{R}^pX=(X1,X2,…,Xp)X=(X1,X2,…,Xp)X = (X_1, X_2, \dots, X_p)XXXkkkp=1p=1p = 1∫Rxkf(x)dx<∞,∫Rxkf(x)dx<∞,\int_{\mathbb{R}} …

Durch die Nutzung unserer Website bestätigen Sie, dass Sie unsere Cookie-Richtlinie und Datenschutzrichtlinie gelesen und verstanden haben.
Licensed under cc by-sa 3.0 with attribution required.