Eine peinlich einfache Frage - aber es scheint, dass sie bei Cross Validated noch nicht gestellt wurde: Was ist die Definition eines Regressionsmodells? Auch eine Support-Frage, Was ist kein Regressionsmodell? In Bezug auf Letzteres interessieren mich knifflige Beispiele, bei denen die Antwort nicht sofort offensichtlich ist. Beispielsweise, Was ist mit …
Entschuldigen Sie die vage Frage, aber diese Tabelle erscheint bei Biddle et al. 2009 und ich habe so etwas noch nie erlebt. Es ist ein Balkendiagramm mit abgeschrägten Kanten, manchmal "Hörnern". Was bedeuten diese? Hat dieser Diagrammtyp einen Namen? Per /meta/244083/site-for-asking-about-charts hielt ich Academia für den besten Ort, um zu …
Ich habe einen Datensatz, der sowohl kategoriale als auch kontinuierliche Variablen enthält. Mir wurde geraten, die kategorialen Variablen als Binärvariablen für jede Ebene zu transformieren (dh A_level1: {0,1}, A_level2: {0,1}) - ich denke, einige haben dies "Dummy-Variablen" genannt. Wäre es dann irreführend, den gesamten Datensatz mit den neuen Variablen zu …
Allgemeiner Konsens zu einer ähnlichen Frage: Ist es falsch, die Ergebnisse als "hoch signifikant" zu bezeichnen? ist, dass "hoch signifikant" eine gültige, wenn auch unspezifische Methode ist, um die Stärke einer Assoziation zu beschreiben, deren p-Wert weit unter Ihrer voreingestellten Signifikanzschwelle liegt. Wie sieht es jedoch mit der Beschreibung von …
Diese Frage ist inspiriert von der langen Diskussion in den Kommentaren hier: Wie verwendet die lineare Regression die Normalverteilung? In dem üblichen linearen Regressionsmodell wird hier der Einfachheit halber mit nur einem Prädiktor geschrieben: wobei bekannte Konstanten sind und unabhängige Fehlerterme mit dem Mittelwert Null sind. Wenn wir zusätzlich Normalverteilungen …
Ich habe einen Datensatz bestehend aus 15K markierten Proben (von 10 Gruppen). Ich möchte die Dimensionsreduktion in 2 Dimensionen anwenden, die die Kenntnis der Etiketten berücksichtigen. Wenn ich "Standard" -Verfahren zur unbeaufsichtigten Dimensionsreduktion wie PCA verwende, scheint das Streudiagramm nichts mit den bekannten Beschriftungen zu tun zu haben. Hat das, …
Soweit ich weiß, werden Hauptkomponenten durch Drehen der Koordinatenachsen erhalten, um sie an den Richtungen der maximalen Varianz auszurichten. Trotzdem lese ich immer wieder über "nicht gedrehte Hauptkomponenten" und meine Statistiksoftware (SAS) gibt mir sowohl varimax-gedrehte als auch nicht gedrehte Hauptkomponenten. Hier bin ich verwirrt: Wenn wir Hauptkomponenten berechnen, sind …
Ich benutze ein LSTM- und Feed-Forward-Netzwerk, um Text zu klassifizieren. Ich konvertiere den Text in One-Hot-Vektoren und speise jeden in den lstm ein, damit ich ihn als eine einzige Darstellung zusammenfassen kann. Dann füttere ich es dem anderen Netzwerk. Aber wie trainiere ich das lstm? Ich möchte den Text nur …
Ich habe Yoshua Bengios Buch über tiefes Lernen gelesen und auf Seite 224 steht: Faltungsnetzwerke sind einfach neuronale Netzwerke, die Faltung anstelle der allgemeinen Matrixmultiplikation in mindestens einer ihrer Schichten verwenden. Ich war mir jedoch nicht hundertprozentig sicher, wie man "Matrixmultiplikation durch Faltung ersetzen" kann. Was mich wirklich interessiert, ist, …
Ich bin daran interessiert, verschiedene Metriken für Ranking-Algorithmen zu untersuchen. Einige davon sind auf der Wikipedia-Seite Lernen, Ranglisten zu erstellen aufgeführt, darunter: • Mittlere durchschnittliche Genauigkeit (MAP); • DCG und NDCG; • Precision @ n, NDCG @ n, wobei "@n" angibt, dass die Metriken nur in den ersten n Dokumenten …
Was ist eine partielle F-Statistik? Ist das dasselbe wie ein partieller F-Test? Wann würden Sie eine partielle F-Statistik berechnen? Ich gehe davon aus, dass dies etwas mit dem Vergleich von Regressionsmodellen zu tun hat, aber ich verfolge etwas nicht (?)
Ich benutze kkk bedeutet Clustering, um Lautsprecherstimmen zu gruppieren. Wenn ich eine Äußerung mit gruppierten Sprecherdaten vergleiche, erhalte ich eine (euklidische entfernungsbasierte) durchschnittliche Verzerrung. Dieser Abstand kann im Bereich von . Ich möchte diesen Abstand in einen Ähnlichkeitswert umrechnen . Bitte leiten Sie mich, wie ich dies erreichen kann.[0,∞][0,∞][0,\infty][0,1][0,1][0,1]
In Regressionsmodellierungsstrategien von Harrell (zweite Ausgabe) wird in Abschnitt (S. 20.1.7) auf Cox-Modelle eingegangen, einschließlich einer Wechselwirkung zwischen einer Kovariate, deren Haupteffekt auf das Überleben ebenfalls geschätzt werden soll (Alter im folgenden Beispiel), und a Kovariate, deren Haupteffekt wir nicht einschätzen wollen (Geschlecht im Beispiel unten). Konkret: Nehmen wir an, …
Durch Lesen der hervorragenden statistischen Modellierung: Die beiden Kulturen (Breiman 2001) können wir den Unterschied zwischen traditionellen statistischen Modellen (z. B. lineare Regression) und Algorithmen für maschinelles Lernen (z. B. Bagging, Random Forest, Boosted trees ...) erfassen. Breiman kritisiert Datenmodelle (parametrisch), weil sie auf der Annahme beruhen, dass die Beobachtungen …
Wie ist die langfristige Varianz im Bereich der Zeitreihenanalyse definiert? Ich verstehe, dass es für den Fall verwendet wird, dass die Daten eine Korrelationsstruktur aufweisen. Unser stochastischer Prozess wäre also keine Familie von X1,X2…X1,X2…X_1, X_2 \dots iid Zufallsvariablen, sondern nur identisch verteilt? Könnte ich eine Standardreferenz als Einführung in das …
We use cookies and other tracking technologies to improve your browsing experience on our website,
to show you personalized content and targeted ads, to analyze our website traffic,
and to understand where our visitors are coming from.
By continuing, you consent to our use of cookies and other tracking technologies and
affirm you're at least 16 years old or have consent from a parent or guardian.