Ist es in Ordnung, mit dem Kolmogorov-Smirnov-Anpassungstest zwei empirische Verteilungen zu vergleichen, um festzustellen, ob sie aus derselben zugrunde liegenden Verteilung stammen, anstatt eine empirische Verteilung mit einer vorgegebenen Referenzverteilung zu vergleichen? Lassen Sie mich versuchen, dies anders zu stellen. Ich sammle N Proben von einer Verteilung an einem Ort. …
Ich habe einen Datensatz, ich möchte Cluster auf diesen Daten basierend auf nur einer Variablen erstellen (es fehlen keine Werte). Ich möchte 3 Cluster basierend auf dieser einen Variablen erstellen. Welcher Clustering-Algorithmus soll verwendet werden, k-means, EM, DBSCAN usw.? Meine Hauptfrage ist, unter welchen Umständen sollte ich k-means über EM …
Ich versuche, Clustering auf Dokumentebene durchzuführen. Ich habe die Term-Document-Frequenzmatrix konstruiert und versuche, diese hochdimensionalen Vektoren mit k-Mitteln zu clustern. Anstatt direkt zu clustern, habe ich zuerst die LSA-Singularvektorzerlegung (Latent Semantic Analysis) angewendet, um die U, S, Vt-Matrizen zu erhalten, eine geeignete Schwelle unter Verwendung des Geröllplots ausgewählt und Clusterbildung …
Ich dachte, dass "Daten bündeln" einfach das Kombinieren von Daten bedeutet, die zuvor in Kategorien unterteilt waren ... im Wesentlichen, die Kategorien zu ignorieren und den Datensatz zu einem riesigen "Datenpool" zu machen. Ich denke, das ist mehr eine Frage der Terminologie als der Anwendung von Statistiken. Zum Beispiel: Ich …
Ich versuche, Zufallsstichproben aus einem benutzerdefinierten PDF mit R zu generieren. Mein PDF lautet: fX( x ) = 32( 1 - x2) , 0 ≤ x ≤ 1fX(x)=32(1-x2),0≤x≤1f_{X}(x) = \frac{3}{2} (1-x^2), 0 \le x \le 1 Ich habe einheitliche Samples generiert und dann versucht, diese in meine benutzerdefinierte Distribution umzuwandeln. …
Ich habe versucht, einen Algorithmus zu programmieren, der Wetten in 1X2-Spielen (gewichtet) vorschlägt. Grundsätzlich hat jedes Spiel eine Reihe von Spielen (Heim- gegen Auswärtsteams): 1: Heimsiege X: zeichnen 2: auswärts gewinnt Für jede Übereinstimmung und jedes Symbol ( 1, Xund 2) werde ich einen Prozentsatz zuweisen, der die Wahrscheinlichkeit angibt, …
Verschlossen . Diese Frage und ihre Antworten sind gesperrt, da die Frage nicht zum Thema gehört, aber von historischer Bedeutung ist. Derzeit werden keine neuen Antworten oder Interaktionen akzeptiert. Dank der Tormod-Frage ( hier gepostet ) bin ich auf den Plot Parallel Sets gestoßen. Hier ist ein Beispiel dafür, wie …
Im Allgemeinen standardisiere ich meine unabhängigen Variablen in Regressionen, um die Koeffizienten richtig zu vergleichen (auf diese Weise haben sie die gleichen Einheiten: Standardabweichungen). Bei Panel- / Längsschnittdaten bin ich mir jedoch nicht sicher, wie ich meine Daten standardisieren soll, insbesondere wenn ich ein hierarchisches Modell schätze. Um zu sehen, …
Ich erkunde verschiedene Klassifizierungsmethoden für ein Projekt, an dem ich arbeite, und bin daran interessiert, Random Forests auszuprobieren. Ich versuche mich weiterzubilden und würde mich über jede Hilfe durch die CV-Community freuen. Ich habe meine Daten in Trainings- / Test-Sets aufgeteilt. Durch Experimente mit zufälligen Gesamtstrukturen in R (mit dem …
Ich analysiere die Ergebnisse von Teilnehmern, die an einem Experiment teilgenommen haben. Ich möchte die Zuverlässigkeit meines Fragebogens einschätzen, der sich aus 6 Elementen zusammensetzt, um die Einstellung der Teilnehmer zu einem Produkt einzuschätzen. Ich habe Cronbachs Alpha berechnet, indem ich alle Elemente als eine einzige Skala (Alpha war ungefähr …
Ich habe mehrmals versucht, es "alleine zu machen" - aber mit begrenztem Erfolg. Ich bin ein gelegentlicher SPSS-Benutzer und habe einige SAS-Erfahrungen. Würde mich über einen oder zwei Zeiger von jemandem freuen, der einen ähnlichen Hintergrund hat und jetzt R verwendet.
Ich benötige einige Ressourcen, um mit der Verwendung neuronaler Netze für die Vorhersage von Zeitreihen zu beginnen. Ich bin vorsichtig, wenn ich etwas Papier umsetze und dann herausfinde, dass sie das Potenzial ihrer Methoden stark überbewertet haben. Wenn Sie also Erfahrung mit den Methoden haben, die Sie vorschlagen, wird es …
Wenn ich zwei normalverteilte unabhängige Zufallsvariablen und mit den Bedeutungen und und den Standardabweichungen und und feststelle, dass , dann gilt (vorausgesetzt, ich habe keine Fehler gemacht) die bedingte Verteilung von und denen sind auch normal mit den Mitteln und Standardabweichung XXXYYYμXμX\mu_XμYμY\mu_YσXσX\sigma_XσYσY\sigma_YX+Y=cX+Y=cX+Y=cXXXYYYcccμX|c=μX+(c−μX−μY)σ2Xσ2X+σ2YμX|c=μX+(c−μX−μY)σX2σX2+σY2\mu_{X|c} = \mu_X + (c - \mu_X - \mu_Y)\frac{ …
Geschlossen. Diese Frage ist nicht zum Thema . Derzeit werden keine Antworten akzeptiert. Möchten Sie diese Frage verbessern? Aktualisieren Sie die Frage so dass es beim Thema für Kreuz Validated. Geschlossen vor 4 Jahren . Ich habe einen Datenrahmen, der einige doppelte IDs enthält. Ich möchte Datensätze mit doppelten IDs …
We use cookies and other tracking technologies to improve your browsing experience on our website,
to show you personalized content and targeted ads, to analyze our website traffic,
and to understand where our visitors are coming from.
By continuing, you consent to our use of cookies and other tracking technologies and
affirm you're at least 16 years old or have consent from a parent or guardian.