"Bootstrap Validation" / "Resampling Cross-Validation" ist für mich neu, wurde aber bei der Beantwortung dieser Frage besprochen . Ich nehme an, es handelt sich um zwei Arten von Daten: die realen Daten und die simulierten Daten, wobei ein bestimmter Satz von simulierten Daten durch erneutes Abtasten mit Ersetzen aus den …
Verschlossen . Diese Frage und ihre Antworten sind gesperrt, da die Frage nicht zum Thema gehört, aber von historischer Bedeutung ist. Derzeit werden keine neuen Antworten oder Interaktionen akzeptiert. Ich habe folgendes Problem, während ich eine Analyse mit R durchführe. Ich habe einen Datenrahmen wie diesen: Name | Group | …
Wie berechnet man die R-Quadrat- Statistik ( ) in R für und / oder die Funktionsausgabe? Zum Beispiel für diese Daten:r2r2r^2loesspredict cars.lo <- loess(dist ~ speed, cars) cars.lp <- predict(cars.lo, data.frame(speed = seq(5, 30, 1)), se = TRUE) cars.lphat zwei Arrays fitfür Modell- und se.fitfür Standardfehler.
Ich denke an die angepassten R-Quadrat-Formeln, die vorgeschlagen werden von: Ezekiel (1930), von dem ich glaube, dass er derzeit in SPSS verwendet wird. R2a d j u s t e d= 1 -( N- 1 )( N- p - 1 )( 1 - R2)Reindjusted2=1-(N-1)(N-p-1)(1-R2)R^2_{\rm adjusted} = 1 - \frac{(N-1)}{(N-p-1)} (1-R^2) …
1. Gibt es eine Namenskonvention für den Hut und das Tildesymbol in den Statistiken? Ich fand β für einen Schätzer beschreibt ( Wikipedia ) Aber ich fand auch beschreibt einen Schätzer für ( Wolfram ). Gibt es einen Unterschied in der Bedeutung? Im Internet habe ich einen Unterschied festgestellt, bin …
Nachdem ich hier die linearen Modellkoeffizienten geklärt habe, habe ich eine weitere Frage bezüglich der Nicht-Signifikanz (hoher p-Wert) für Koeffizienten von Faktorstufen. Beispiel: Wenn mein lineares Modell einen Faktor mit 10 Stufen enthält und nur 3 dieser Stufen mit signifikanten p-Werten verknüpft sind, kann ich bei Verwendung des Modells zur …
Ich möchte den Analyseprozess kennenlernen oder Referenzen darüber haben, den die meisten statistischen Datenanalysten für jedes Datenanalyseprojekt durchlaufen. Wenn ich eine "Liste" erstelle, um das Datenanalyseprojekt abzuschließen, muss ein Analyst: Sammeln Sie zuerst die Anforderungen für das Projekt. Planen / Gestalten Sie seine Datenanalyse auf der Grundlage dieser Anforderungen Daten …
Ich habe Antworten von 85 Personen zu ihrer Fähigkeit, bestimmte Aufgaben zu erledigen, gesammelt. Die Antworten sind auf einer Fünf-Punkte-Likert-Skala: 5 = sehr gut, 4 = gut, 3 = durchschnittlich, 2 = schlecht, 1 = sehr schlecht, Der Mittelwert liegt bei 2,8 und die Standardabweichung bei 0,54. Ich verstehe, wofür …
Ich analysiere Daten aus einem unausgeglichenen faktoriellen Experiment mit SASund R. Beide SASund Rliefern eine ähnliche Quadratsumme vom Typ I, aber ihre Quadratsumme vom Typ III unterscheidet sich voneinander. Im Folgenden sind SASund RCodes und Ausgänge. DATA ASD; INPUT Y T B; DATALINES; 20 1 1 25 1 2 26 …
CARET verwendet automatisch ein vorab festgelegtes Abstimmungsraster, um verschiedene Modelle zu erstellen, bevor ein endgültiges Modell ausgewählt wird, und trainiert dann das endgültige Modell mit den vollständigen Trainingsdaten. Ich kann mein eigenes Stimmraster mit nur einer Kombination von Parametern versorgen. Aber auch in diesem Fall "wählt" CARET das beste Modell …
Ich muss auf meinem Laptop einen linearen Klassifikator mit hunderttausenden Datenpunkten und etwa zehntausenden Funktionen trainieren. Welche Möglichkeiten habe ich? Was ist der Stand der Technik für diese Art von Problem? Der stochastische Gradientenabstieg scheint eine vielversprechende Richtung zu sein, und ich bin der Meinung, dass dies auf dem neuesten …
Ich lese "Die Rolle des Schachs in der Forschung der künstlichen Intelligenz" ( pdf ) und es heißt interessanterweise: Die Erfahrung [...] zeigt, dass die Beiträge von Schachexperten zwar allgemein nützlich, aber nicht vollständig vertrauenswürdig sind. Ein gutes Beispiel dafür ist die Bewertungsfunktion von Deep Thought. Einige Änderungen durch fähige …
Angenommen, ich habe ein Vorhersagemodell für das Auftreten einer bestimmten Krankheit in einem Datensatz (dem Datenbestand zur Modellbildung) erstellt und möchte nun überprüfen, wie gut das Modell in einem neuen Datensatz (dem Validierungsdatenbestand) funktioniert. Für ein mit logistischer Regression erstelltes Modell würde ich die vorhergesagte Wahrscheinlichkeit für jede Person im …
Ich habe mich gefragt, warum LASSO- und LARS-Modellauswahlmethoden so beliebt sind, obwohl sie im Grunde genommen nur Variationen der schrittweisen Vorauswahl sind (und daher unter Pfadabhängigkeit leiden). Warum werden GETS-Methoden (General to Specific) für die Modellauswahl meist ignoriert, obwohl sie besser sind als LARS / LASSO, weil sie nicht unter …
Im Rahmen einer Aufgabe muss ich einen genetischen Programmieralgorithmus schreiben , der die Luftschadstoffwerte vorhersagt. Da ich keine Erfahrung habe, kann mir jemand Hinweise auf Vorschläge von Programmiersprachen geben, in denen weiterentwickelte Programme geschrieben werden . Klarstellung: Ich frage nicht, in welcher Sprache ich den genetischen Algorithmus selbst schreiben werde …
We use cookies and other tracking technologies to improve your browsing experience on our website,
to show you personalized content and targeted ads, to analyze our website traffic,
and to understand where our visitors are coming from.
By continuing, you consent to our use of cookies and other tracking technologies and
affirm you're at least 16 years old or have consent from a parent or guardian.