Wenn ich 232 Personen aus einem Pool von 363 ersatzlosen Personen auswähle, wie hoch ist die Wahrscheinlichkeit, dass 2 einer Liste von 12 bestimmten Personen in dieser Auswahl enthalten sind? Dies ist eine zufällige Auslosung für ein Ultra-Rennen, bei dem 363 Teilnehmer für 232 Plätze anwesend waren. Es gibt ein …
Es fällt mir schwer zu akzeptieren, dass Donald Rubin jemals eine echte Zitrone einer Technik entwickeln würde. Das ist jedoch meine Wahrnehmung des BESD [ 1 , 2 , 3 ]. Das Originalpapier von Rosenthal und Rubin (1982) behauptete, es sei sinnvoll zu zeigen, "wie eine Produkt-Moment-Korrelation in eine solche …
Ich modelliere einige Daten, bei denen ich denke, dass ich zwei gekreuzte zufällige Effekte habe. Der Datensatz ist jedoch nicht ausgewogen, und ich bin mir nicht sicher, was getan werden muss, um dies zu berücksichtigen. Meine Daten sind eine Reihe von Ereignissen. Ein Ereignis tritt auf, wenn sich ein Client …
Ich habe folgendes lineares Modell: Um die Heteroskedastizität der Residuen zu beheben, habe ich versucht, eine Protokolltransformation auf die abhängige Variable als anzuwenden, aber ich sehe immer noch den gleichen Fan-Out-Effekt auf die Residuen. Die DV-Werte sind relativ klein, so dass die konstante Addition von +1 vor der Protokollierung in …
Ich versuche, den Verkauf von Produkten in Verkaufsautomaten vorherzusagen. Das Problem ist, dass die Maschine in unregelmäßigen Abständen gefüllt wird und wir bei jeder Befüllung nur die aggregierten Verkäufe seit der letzten Befüllung der Maschine erfassen können (dh wir haben keine täglichen Verkaufsdaten). Grundsätzlich haben wir also Daten für aggregierte …
Ich arbeite an einem Datensatz, um die Auswirkungen des Trocknens auf die mikrobiellen Aktivitäten von Sedimenten zu bewerten. Ziel ist es festzustellen, ob die Auswirkungen des Trocknens zwischen den Sedimenttypen und / oder der Tiefe innerhalb des Sediments variieren. Der Versuchsaufbau ist wie folgt: Der erste Faktor Sediment entspricht drei …
Ich habe viele Probleme mit einem Datensatz, auf den ich SEM anwenden möchte. Wir nehmen die Existenz von 5 latenten Faktoren A, B, C, D, E mit Indikatoren bzw. A1 bis A5 (geordnete Faktoren), B1 bis B3 (quantitativ), C1, D1, E1 (alle letzten drei geordneten Faktoren mit nur 2 Ebenen …
Was sind gute Strategien für die Durchführung einer Gaußschen Prozessregression, wenn sich die Funktion, die ich zu approximieren versuche, im Laufe der Zeit ändert? Der naive Ansatz, der mir in den Sinn kommt, besteht darin, nur die N neuesten Datenpunkte zu verwenden, um die Regression durchzuführen. Was sind bessere Strategien?
Für eine Weile schien es, als ob Fisher Kernels populär werden könnten, da sie eine Möglichkeit zu sein schienen, Kernel aus probabilistischen Modellen zu konstruieren. Ich habe sie jedoch selten in der Praxis gesehen, und ich bin der festen Überzeugung, dass sie in der Regel nicht sehr gut funktionieren. Sie …
Ich habe Zugriff auf einen sehr großen Datensatz. Die Daten stammen aus MEG- Aufnahmen von Personen, die Musikausschnitte aus einem von vier Genres hören. Die Daten sind wie folgt: 6 Themen 3 Experimentelle Wiederholungen (Epochen) 120 Prüfungen pro Epoche 8 Sekunden Daten pro Versuch bei 500 Hz (= 4000 Abtastungen) …
Grundsätzlich gibt es zwei gängige Methoden, um gegen große Datenmengen zu lernen (wenn Sie mit zeitlichen / räumlichen Einschränkungen konfrontiert sind): Betrug :) - Verwenden Sie nur eine "überschaubare" Teilmenge für das Training. Der Genauigkeitsverlust kann aufgrund des Gesetzes zur Verringerung der Rendite vernachlässigbar sein - die Vorhersageleistung des Modells …
Ein häufiges Problem ist, dass ML eine schlechte Datenqualität aufweist: Fehler in Merkmalswerten, falsch klassifizierte Instanzen usw. usw. Eine Möglichkeit, dieses Problem zu beheben, besteht darin, die Daten manuell durchzugehen und zu überprüfen. Gibt es jedoch andere Techniken? (Ich wette, es gibt!) Welche sind besser und warum?
Eine Signalverarbeitungstechnik, die Mel-Frequenz Cepstrum , wird häufig verwendet, um Informationen aus einem Musikstück zur Verwendung in einer maschinellen Lernaufgabe zu extrahieren. Diese Methode liefert ein kurzfristiges Leistungsspektrum, und die Koeffizienten werden als Eingabe verwendet. Beim Entwerfen von Musikabrufsystemen werden solche Koeffizienten als charakteristisch für ein Stück angesehen (offensichtlich nicht …
Interviewstreet hatte im Januar ihren zweiten CodeSprint, der die folgende Frage enthielt. Die programmatische Antwort wird veröffentlicht, enthält jedoch keine statistische Erklärung. (Sie können das ursprüngliche Problem und die veröffentlichte Lösung anzeigen, indem Sie sich mit Google Creds auf der Interviewstreet-Website anmelden und dann auf dieser Seite zum Coin Tosses-Problem …
Betrachten Sie den folgenden R-Code: example <- function(n) { X <- 1:n Y <- rep(1,n) return(lm(Y~X)) } #(2.13.0, i386-pc-mingw32) summary(example(7)) #R^2 = .1963 summary(example(62)) #R^2 = .4529 summary(example(4540)) #R^2 = .7832 summary(example(104))) #R^2 = 0 #I did a search for n 6:10000, the result for R^2 is NaN for #n …
We use cookies and other tracking technologies to improve your browsing experience on our website,
to show you personalized content and targeted ads, to analyze our website traffic,
and to understand where our visitors are coming from.
By continuing, you consent to our use of cookies and other tracking technologies and
affirm you're at least 16 years old or have consent from a parent or guardian.