Diese Frage wurde von Stack Overflow migriert, da sie bei Cross Validated beantwortet werden kann. Vor 8 Jahren migriert . Ich habe 2 Variablen, beide aus der Klasse "numerisch": > head(y) [1] 0.4651804 0.6185849 0.3766175 0.5489810 0.3695258 0.4002567 > head(x) [1] 59.32820 68.46436 80.76974 132.90824 216.75995 153.25551 Ich habe sie …
Kontext Eine beliebte Frage auf dieser Website lautet " Was sind häufige statistische Sünden? ". Eine der genannten Sünden ist die Annahme, dass "Korrelation Kausalität impliziert ..." ein Zusammenhang ist In den Kommentaren mit 5 positiven Stimmen heißt es dann: "Google verdient 65 Milliarden Dollar pro Jahr, ohne sich um …
Kontext Ich habe über die Item-Response-Theorie gelesen und finde sie faszinierend. Ich glaube, ich verstehe die Grundlagen, aber ich frage mich, wie ich statistische Techniken anwenden soll, die sich auf das Gebiet beziehen. Im Folgenden finden Sie zwei Artikel, die dem Bereich ähnlich sind, in dem ich ITR anwenden möchte: …
Verschlossen . Diese Frage und ihre Antworten sind gesperrt, da die Frage nicht zum Thema gehört, aber von historischer Bedeutung ist. Derzeit werden keine neuen Antworten oder Interaktionen akzeptiert. Könnte jemand einige Hinweise zur Verwendung des weightsArguments in der lmFunktion von R geben ? Angenommen, Sie haben versucht, ein Modell …
Eine Poisson-Regression ist ein GLM mit einer Log-Link-Funktion. Eine alternative Möglichkeit, nicht normalverteilte Zählerdaten zu modellieren, besteht in der Vorverarbeitung, indem das Protokoll (bzw. das Protokoll (1 + Zähler) zur Behandlung von Nullen) verwendet wird. Wenn Sie eine Regression der kleinsten Quadrate für die Anzahl der logarithmischen Antworten durchführen, hängt …
Ich muss ein Programm implementieren, das Datensätze basierend auf einigen Trainingsdaten in 2 Kategorien (wahr / falsch) klassifiziert, und ich habe mich gefragt, welchen Algorithmus / welche Methodik ich betrachten soll. Es scheint eine Menge von ihnen zur Auswahl zu geben - künstliches neuronales Netzwerk, genetischer Algorithmus, maschinelles Lernen, Bayesianische …
In der statistischen Modellierung: Die zwei Kulturen schreibt Leo Breiman Die derzeitige angewandte Praxis besteht darin, die Anpassung des Datenmodells mithilfe von Anpassungstests und Restanalyse zu überprüfen. Vor einigen Jahren habe ich einmal ein simuliertes Regressionsproblem in sieben Dimensionen mit einem kontrollierten Maß an Nichtlinearität erstellt. Standardtests der Anpassungsgüte lehnten …
Ich möchte mehr über nichtparametrische Bayesianische (und verwandte) Techniken erfahren. Mein Hintergrund liegt in der Informatik, und obwohl ich noch nie einen Kurs in Maß- oder Wahrscheinlichkeitstheorie belegt habe, habe ich nur ein begrenztes Maß an formaler Ausbildung in Wahrscheinlichkeits- und Statistikwissenschaften erhalten. Kann mir jemand eine lesbare Einführung in …
SPSS liefert die Ausgabe "Konfidenzintervall der Differenzmittel". Ich habe an einigen Stellen gelesen, dass es bedeutet, dass "95 mal von 100, unsere mittlere Stichprobendifferenz wird zwischen diesen Grenzen liegen". Ich finde dies unklar. Kann jemand eine klarere Formulierung vorschlagen, um das "Konfidenzintervall der Mittelwertdifferenz" zu erklären? Diese Ausgabe erscheint im …
Um (Text-) Dokumente zu gruppieren, müssen Sie die Ähnlichkeit zwischen Dokumentenpaaren messen. Zwei Alternativen sind: Vergleichen Sie Dokumente als Termvektoren mit Cosine Similarity - und TF / IDF als Gewichtungen für Terme. Vergleichen Sie die Wahrscheinlichkeitsverteilung jedes Dokuments mit f-Divergenz, z. B. Kullback-Leibler-Divergenz Gibt es einen intuitiven Grund, eine Methode …
Ich habe einige Daten, an die ich eine Trendlinie anpassen möchte. Ich bin der Meinung, dass die Daten einem Potenzgesetz folgen, und habe daher die Daten auf Log-Log-Achsen aufgezeichnet, die nach einer geraden Linie suchen. Dies hat zu einer (fast) geraden Linie geführt und so habe ich in Excel eine …
Hinweis: Groß- / Kleinschreibung ist n >> p Ich lese Elemente des statistischen Lernens und es gibt verschiedene Erwähnungen über den "richtigen" Weg zur Kreuzvalidierung (z. B. Seite 60, Seite 245). Insbesondere ist meine Frage, wie das endgültige Modell (ohne einen separaten Testsatz) mit einem k-fach CV oder einem Bootstrapping …
Ich bin in keiner Weise Statistiker (ich hatte einen Kurs in mathematischer Statistik, aber nichts anderes als das), und vor kurzem, als ich Informationstheorie und statistische Mechanik studierte, traf ich dieses Ding, das "Unsicherheitsmaß" / "Entropie" genannt wurde. Ich habe die Khinchin-Ableitung als Maß für die Unsicherheit gelesen und es …
Ich habe Log-Normalverteilungen als frühere Verteilungen für Skalenparameter verwendet (für Normalverteilungen, t-Verteilungen usw.), wenn ich eine ungefähre Vorstellung davon habe, wie die Skala aussehen soll, mich aber irren möchte, wenn ich sage, dass ich es nicht weiß viel darüber. Ich benutze es, weil die Verwendung für mich intuitiv sinnvoll ist, …
We use cookies and other tracking technologies to improve your browsing experience on our website,
to show you personalized content and targeted ads, to analyze our website traffic,
and to understand where our visitors are coming from.
By continuing, you consent to our use of cookies and other tracking technologies and
affirm you're at least 16 years old or have consent from a parent or guardian.