Ich habe verschiedene (scheinbar) widersprüchliche Aussagen darüber gelesen, ob AdaBoost (oder andere Boosting-Techniken) im Vergleich zu anderen Lernmethoden weniger oder anfälliger für Überanpassungen sind. Gibt es gute Gründe, den einen oder anderen zu glauben? Wenn es darauf ankommt, wovon hängt es ab? Was sind die Gründe, warum AdaBoost weniger / …
Ich bin ein bisschen neu in Datamining / Maschinelles Lernen / etc. und haben über ein paar Möglichkeiten gelesen, mehrere Modelle und Läufe desselben Modells zu kombinieren, um Vorhersagen zu verbessern. Mein Eindruck beim Lesen einiger Artikel (die oft interessant und großartig in Bezug auf Theorie und griechische Buchstaben, aber …
(Um zu sehen, warum ich das geschrieben habe, lesen Sie die Kommentare unter meiner Antwort auf diese Frage .) Typ-III-Fehler und statistische Entscheidungstheorie Die richtige Antwort auf die falsche Frage zu geben, wird manchmal als Typ-III-Fehler bezeichnet. Die statistische Entscheidungstheorie ist eine Formalisierung der Entscheidungsfindung unter Unsicherheit. Es bietet einen …
Bitte beweisen Sie, dass, wenn wir zwei Variablen (gleiche Stichprobengröße) und Y haben und die Varianz in X größer als in Y ist , die Summe der quadrierten Differenzen (dh der quadrierten euklidischen Abstände) zwischen Datenpunkten in X ebenfalls größer als ist dass innerhalb von Y .XXXYYYXXXYYYXXXYYY
Ich habe zwei Fragen zum Blockbegriff in der Versuchsplanung: (1) Was ist der Unterschied zwischen einem Block und einem Faktor? (2) Ich habe versucht, einige Bücher zu lesen, aber etwas ist nicht klar: Es scheint, dass die Autoren immer davon ausgehen, dass es keine Wechselwirkung zwischen dem "Blockfaktor" und anderen …
Kann mir jemand raten, ob Folgendes sinnvoll ist: Ich habe es mit einem gewöhnlichen linearen Modell mit 4 Prädiktoren zu tun. Ich bin mir nicht sicher, ob ich den am wenigsten signifikanten Begriff streichen soll. Der Wert liegt etwas über 0,05. Ich habe mich dafür ausgesprochen, diesen Begriff in diese …
Zwei gängige Ansätze zur Auswahl korrelierter Variablen sind Signifikanztests und Kreuzvalidierung. Welches Problem versucht jeder zu lösen und wann würde ich eins dem anderen vorziehen?
Ich habe mir die Modellierung gemischter Effekte mit dem lme4-Paket in R angesehen. Ich verwende hauptsächlich den lmerBefehl, also stelle ich meine Frage durch Code, der diese Syntax verwendet. Ich nehme an, eine allgemeine einfache Frage könnte sein, ob es in Ordnung ist, zwei Modelle zu vergleichen, die unter lmerVerwendung …
Das ist also eine seltsame Passform, obwohl ich wirklich denke, dass es für jede Site eine seltsame Passform ist. Deshalb dachte ich, ich würde es hier unter meinen datenverdächtigen Brüdern versuchen. Ich bin aus der Biologie in die Epidemiologie und Biostatistik gekommen und habe immer noch Gewohnheiten aus diesem Bereich. …
Gibt es statistische Tests, die parametrisch und nicht parametrisch sind? Diese Frage wurde von einem Interviewpanel gestellt. Ist es eine gültige Frage?
Kann mich jemand auf ein Umfragepapier zu "Large , Small n " -Ergebnissen verweisen ? Ich bin daran interessiert, wie dieses Problem manifestiert sich in verschiedenen Forschungskontexten, zB Regression, Klassifikation, Hotelling - Test, etc .pppnnn
Ich habe die logistische Regression immer als einen speziellen Fall der binomischen Regression betrachtet, bei dem die Verknüpfungsfunktion die logistische Funktion ist (anstelle einer Probit-Funktion). Nach dem Lesen der Antworten auf eine andere Frage, die ich hatte, könnte ich verwirrt sein, und es gibt einen Unterschied zwischen logistischer Regression und …
Wir verwenden manchmal Spektraldichtediagramme, um die Periodizität in Zeitreihen zu analysieren. Normalerweise analysieren wir den Plot durch visuelle Inspektion und versuchen dann, eine Schlussfolgerung über die Periodizität zu ziehen. Aber haben die Statistiker einen Test entwickelt, um zu überprüfen, ob sich Spitzen im Diagramm statistisch von weißem Rauschen unterscheiden? Haben …
Ich habe eine einfache lineare Regression des natürlichen Logarithmus von 2 Variablen durchgeführt, um festzustellen, ob sie korrelieren. Meine Ausgabe ist diese: R^2 = 0.0893 slope = 0.851 p < 0.001 Ich bin verwirrt. Wenn ich den Wert betrachte, würde ich sagen, dass die beiden Variablen nicht korreliert sind, da …
aus math.stackexchange migriert . Ich verarbeite einen langen Strom von ganzen Zahlen und überlege, einige Momente nachzuverfolgen, um ungefähr verschiedene Perzentile für den Strom berechnen zu können, ohne viele Daten zu speichern. Was ist der einfachste Weg, um Perzentile von wenigen Augenblicken an zu berechnen? Gibt es einen besseren Ansatz, …
We use cookies and other tracking technologies to improve your browsing experience on our website,
to show you personalized content and targeted ads, to analyze our website traffic,
and to understand where our visitors are coming from.
By continuing, you consent to our use of cookies and other tracking technologies and
affirm you're at least 16 years old or have consent from a parent or guardian.