Ich habe kürzlich den Rat gelesen, dass Sie im Allgemeinen den Median verwenden sollten, um Ausreißer zu eliminieren. Beispiel: Der folgende Artikel http://www.amazon.com/Forensic-Science-Introduction-Scientific-Investigative/product-reviews/1420064932/ hat im Moment 16 Bewertungen: review= c(5, 5, 5, 5, 5, 5, 5, 5, 5, 5, 4, 4, 3, 2, 1, 1) summary(review) ## "ordinary" summary Min. …
Ich hoffe, dass ich diese Frage richtig stellen kann. Ich habe Zugriff auf Play-by-Play-Daten, daher ist es eher ein Problem mit der besten Vorgehensweise und der korrekten Erstellung der Daten. Was ich tun möchte, ist zu berechnen, wie wahrscheinlich es ist, ein NHL-Spiel zu gewinnen, wenn das Ergebnis und die …
Ich habe einen Clustering-Algorithmus (nicht k-means) mit dem Eingabeparameter (Anzahl der Cluster). Nach dem Clustering möchte ich ein quantitatives Qualitätsmaß für dieses Clustering erhalten. Der Clustering-Algorithmus hat eine wichtige Eigenschaft. Für erhalte ich, wenn ich Datenpunkte ohne signifikante Unterscheidung zwischen diesen in diesen Algorithmus einspeise, einen Cluster mit Datenpunkten und …
Um ein Konfidenzniveau auf eine Wahrscheinlichkeit beim überwachten Lernen zu kalibrieren (z. B. um das Vertrauen aus einer SVM oder einem Entscheidungsbaum unter Verwendung von überabgetasteten Daten abzubilden), besteht eine Methode in der Verwendung der Plattschen Skalierung (z. B. Erhalten kalibrierter Wahrscheinlichkeiten aus dem Boosten) ). Grundsätzlich verwendet man die …
Verschlossen . Diese Frage und ihre Antworten sind gesperrt, da die Frage nicht zum Thema gehört, aber von historischer Bedeutung ist. Derzeit werden keine neuen Antworten oder Interaktionen akzeptiert. In R habe ich einen Datenrahmen, der eine Klassenbezeichnung C (einen Faktor) und zwei Messungen M1 und M2 umfasst . Wie …
In einer früheren Frage habe ich nach Tools zum Bearbeiten von CSV-Dateien gefragt . Gavin ist mit einem Kommentar zu R Help von Duncan Murdoch verknüpft, der darauf hinweist , dass das Datenaustauschformat eine zuverlässigere Methode zum Speichern von Daten ist als CSV. Für einige Anwendungen ist ein dediziertes Datenbankverwaltungssystem …
Ich habe eine Hauptkomponentenanalyse von sechs Variablen , , , , und . Wenn ich das richtig verstehe, sagt mir der nicht gedrehte PC1, welche lineare Kombination dieser Variablen die größte Abweichung in den Daten beschreibt / erklärt, und der PC2 sagt mir, welche lineare Kombination dieser Variablen die nächstgrößere …
Ich habe Daten von Patienten, die während der Operation mit 2 verschiedenen Arten von Behandlungen behandelt wurden. Ich muss die Auswirkung auf die Herzfrequenz analysieren. Die Herzfrequenzmessung erfolgt alle 15 Minuten. Da die Operationsdauer für jeden Patienten unterschiedlich sein kann, kann jeder Patient zwischen 7 und 10 Herzfrequenzmessungen durchführen. Daher …
Diese Frage wird an anderer Stelle diskutiert . Variable Kernel werden häufig in der lokalen Regression verwendet. Zum Beispiel ist Löss weit verbreitet und eignet sich gut als Regressionsglätter. Es basiert auf einem Kernel mit variabler Breite, der sich an die Datensparsität anpasst. Andererseits wird angenommen, dass variable Kernel zu …
Ich habe diesen Thread durchgelesen und es sieht für mich so aus, als könnte man sagen: Statistik = Induktion? Wahrscheinlichkeit = Abzug? Aber ich frage mich, ob es vielleicht weitere Details zu dem Vergleich gibt, die mir fehlen. Ist Statistik zum Beispiel gleich Induktion oder ist es nur ein besonderer …
Angenommen, man hat zwei unabhängige Stichproben aus derselben Population, und für die beiden Stichproben wurden unterschiedliche Methoden verwendet, um die Punktschätzung und die Konfidenzintervalle abzuleiten. In trivialen Fällen bündelte eine vernünftige Person nur die beiden Proben und verwendete eine Methode, um die Analyse durchzuführen. Nehmen wir jedoch vorerst an, dass …
Mir ist aufgefallen, dass ich im Laufe der Jahre einige Ideen zu den Unterschieden zwischen Statistik und Biostatistik zusammengetragen habe, aber nie eine formelle Erklärung gehört habe. Was ist der Unterschied zwischen diesen beiden Disziplinen (derzeit)? Und warum begann diese Unterscheidung überhaupt? EDIT: Ich war in meiner ursprünglichen Frage nicht …
Verschlossen . Diese Frage und ihre Antworten sind gesperrt, da die Frage nicht zum Thema gehört, aber von historischer Bedeutung ist. Derzeit werden keine neuen Antworten oder Interaktionen akzeptiert. Ich habe dieses Buch gekauft: So messen Sie alles: Ermitteln des Werts von immateriellen Vermögenswerten im Geschäftsleben und Head First Data …
Ich habe Gegenstände aus psychometrischer Sicht analysiert. Aber jetzt versuche ich, andere Arten von Fragen zu Motivation und anderen Themen zu analysieren. Diese Fragen beziehen sich alle auf Likert-Skalen. Mein erster Gedanke war, die Faktorenanalyse zu verwenden, da angenommen wird, dass die Fragen einige zugrunde liegende Dimensionen widerspiegeln. Aber ist …
Ich versuche, die Null gegen die lokale Alternative E [ X ] > 0 für eine Zufallsvariable X zu testen, die einem leichten bis mittleren Versatz und einer Kurtosis der Zufallsvariablen unterliegt. Gemäß den Vorschlägen von Wilcox in "Einführung in die robuste Schätzung und das Testen von Hypothesen" habe ich …
We use cookies and other tracking technologies to improve your browsing experience on our website,
to show you personalized content and targeted ads, to analyze our website traffic,
and to understand where our visitors are coming from.
By continuing, you consent to our use of cookies and other tracking technologies and
affirm you're at least 16 years old or have consent from a parent or guardian.