In vielen Anwendungen zur Verarbeitung natürlicher Sprache wie Rechtschreibkorrektur, maschinelle Übersetzung und Spracherkennung verwenden wir Sprachmodelle. Sprachmodelle werden normalerweise erstellt, indem gezählt wird, wie oft Wortfolgen (n-Gramm) in einem großen Korpus vorkommen, und die Anzahl normalisiert wird, um eine Wahrscheinlichkeit zu erstellen. Um unsichtbare n-Gramm zu berücksichtigen, verwenden wir Glättungsmethoden …
Ich habe folgendes Problem: Bei gegebenen Eingaben ( dimensionaler Vektor) von Skalaren, geordneten ganzen Zahlen und ungeordneten ganzen Zahlen (dh Beschriftungen) und einer oder mehreren Ausgaben möchte ich Folgendes schätzen:xxxnnnyyy Welche Eingänge erklären die Ausgänge am besten? Inwieweit Variationen eines Eingangs Variationen der Ausgänge implizieren. Dies soll mit der Unsicherheits- …
Ich bin kürzlich in den Bereich des maschinellen Lernens eingetreten. Für ein Projekt, an dem ich arbeite, muss ich Benutzer anhand der Reihenfolge gruppieren, in der sie Webseiten auf einer Website besucht haben. Ich habe Daten in Form von: ['user_id', 1, 2, 4, 6, 3, 7, 3, 2, 4...] Dabei …
Wie soll ich den folgenden Interaktionsterm von 2 kontinuierlichen Prädiktoren in der Ausgabe eines Cox-Proportional-Hazards-Modells interpretieren? Das Gefahrenverhältnis für die Wechselwirkung von X und Y ist> 1, was bedeutet, dass sein log (der ursprüngliche Koeffizient) 0-1 (~ 0,16) beträgt. Die einzelnen Elemente haben eine HR von weniger als eins und …
Ich habe meine Pilotstudie zur Motivation des Sprachenlernens auf einer 6-Punkte-Likert-Skala durchgeführt, aber von 0 (stimme überhaupt nicht zu) bis 5 (stimme voll zu). Ich habe festgestellt, dass ein Kollege in seiner Umfrage 1 bis 6 verwendet hat. Werden meine berechneten Variablen (Summe und Mittelwert) dieselben sein, als hätte ich …
Gibt es eine Möglichkeit, mithilfe der logistischen Regression mehrfach beschriftete Daten zu klassifizieren? Mit mehrfach beschriftet meine ich Daten, die gleichzeitig zu mehreren Kategorien gehören können. Ich möchte diesen Ansatz verwenden, um einige biologische Daten zu klassifizieren.
Nach dem Sammeln der Daten berechnen wir die Bewertung einer beliebigen Likert-Skala (summativ) (zuvor als Faktor in der Faktoranalyse identifiziert), indem wir die Bewertungen der einzelnen Elemente addieren (und möglicherweise die Summe durch die Anzahl der Elemente dividieren, um die durchschnittliche Bewertung zu erhalten). Bei dieser Berechnung gehen wir davon …
Ich versuche, eine inverse Gammaverteilung mit drei Parametern an meine Daten in R oder Python anzupassen. Ich möchte dies mit der Maximum Likelihood Estimation (MLE) tun. Das PDF des inversen Gammas mit drei Parametern ist gegeben durch: Wobei Γ die Gammafunktion ist, ρ die Form ist, α die Skala ist …
Ich möchte eine Wettervorhersage mit Neuronalen Netzen erstellen. Alle Beispiele, die ich gesehen habe, verwendeten nur Werte [-1,1] als Eingabe. Ist es auch möglich, größere Werte (wie Luftdruck, Gradkalkius der letzten Tage, ...) als Eingaben zu verwenden und eine Zahl als Ausgabe zu erhalten? Vielen Dank
Ich habe angenommen (dh ich glaube, ich wurde vor längerer Zeit unterrichtet, als ich mich erinnern kann), dass Regressionsanalysen davon ausgehen, dass eine Stichprobe homogen ist. Ist dies nicht der Fall, müssen Sie entweder Dummy-Variablen zum Code für die verschiedenen in der Stichprobe enthaltenen Gruppen hinzufügen oder eine ANCOVA durchführen, …
Ich habe ein Experiment durchgeführt, um die Reaktion einer Hefe (die 5000 Gene enthält) auf durch Hitzeschock verursachten Stress zu untersuchen. Ich habe eine Liste von 48 Genen, die bei 37 ° C überexprimiert werden, und eine andere Liste von 145 Genen, die bei 42 ° C überexprimiert werden. Es …
Ich weiß, was ein Gaußsches Feld ist. Ich bin mir jedoch nicht ganz sicher, was unter stationär zu verstehen ist. Ich habe dieses stationäre Ding an vielen Orten wie stationären autoregressiven Prozessen usw. gesehen, weiß aber nicht wirklich, was unter stationär zu verstehen ist.
Kann jemand eine gute Bewertungsreferenz (unbedingt kostenloses Online-PDF) vorschlagen, um Statistiken auf College-Ebene aufzufrischen? Ich schaue mir etwas an, das normalerweise einen ersten Kurs in Statistik abdeckt und idealerweise Folgendes abdeckt: Absolute Grundlagen (Mittelwert, Varianz etc.) Große Proben Vertrauensprüfung Hypothesentest (normal, t, chi, F) Lineare Regression / Korrelation Ich brauche …
Ich habe die Daten erhalten, die Verteilung der Daten geplottet und die Funktion qqnorm verwendet, aber es scheint, dass sie keiner Normalverteilung folgt. Welche Verteilung sollte ich also verwenden, um die Daten zu beschreiben? Empirische kumulative Verteilungsfunktion
We use cookies and other tracking technologies to improve your browsing experience on our website,
to show you personalized content and targeted ads, to analyze our website traffic,
and to understand where our visitors are coming from.
By continuing, you consent to our use of cookies and other tracking technologies and
affirm you're at least 16 years old or have consent from a parent or guardian.