Statistiken und Big Data

Fragen und Antworten für Personen, die sich für Statistik, maschinelles Lernen, Datenanalyse, Data Mining und Datenvisualisierung interessieren


1
Wie kann man die Anzahl der Faltungsoperatoren in CNN bestimmen?
Bei Computer-Vision-Aufgaben wie der Objektklassifizierung mit Convolutional Neural Networks (CNN) bietet das Netzwerk eine ansprechende Leistung. Ich bin mir jedoch nicht sicher, wie ich die Parameter in Faltungsschichten einrichten soll. Beispielsweise kann bei einem Graustufenbild ( 480x480) die erste Faltungsschicht einen Faltungsoperator wie verwenden 11x11x10, wobei die Zahl 10 die …

1
ROC-Kurven für unsymmetrische Datensätze
Betrachten Sie eine Eingangsmatrix und einen Binärausgang y .X.XXyyy Eine übliche Methode zur Messung der Leistung eines Klassifikators ist die Verwendung von ROC-Kurven. In einem ROC-Diagramm ist die Diagonale das Ergebnis, das von einem zufälligen Klassifikator erhalten würde. Im Falle einer unsymmetrischen Ausgabe die Leistung eines Zufallsklassifizierers verbessert werden, indem …

2
Wie bekomme ich eine ANOVA-Tabelle mit robusten Standardfehlern?
Ich führe eine gepoolte OLS-Regression mit dem plm-Paket in R aus. Meine Frage bezieht sich jedoch eher auf grundlegende Statistiken. Deshalb versuche ich, sie zuerst hier zu veröffentlichen. Da meine Regressionsergebnisse heteroskedastische Residuen ergeben, möchte ich versuchen, robuste Standardfehler der Heteroskedastizität zu verwenden. Als Ergebnis coeftest(mod, vcov.=vcovHC(mod, type="HC0"))erhalte ich eine …



3
Was sind Kriterien und Entscheidungen für die Nichtlinearität in statistischen Modellen?
Ich hoffe, dass die folgende allgemeine Frage Sinn macht. Bitte beachten Sie, dass ich für die Zwecke dieser speziellen Frage nicht an theoretischen (Fachgebiets-) Gründen für die Einführung von Nichtlinearität interessiert bin. Daher werde ich die vollständige Frage wie folgt formulieren : Was ist ein logischer Rahmen ( Kriterien und, …

1
Vorhersage mit zufälligen Effekten in mgcv gam
Ich bin daran interessiert, den gesamten Fischfang mit gam in mgcv zu modellieren, um einfache zufällige Effekte für einzelne Schiffe zu modellieren (die im Laufe der Zeit wiederholte Fahrten in der Fischerei unternehmen). Ich habe 98 Probanden, also dachte ich, ich würde Gam anstelle von Gamm verwenden, um die zufälligen …







3
glm in R - welcher p-Wert repräsentiert die Anpassungsgüte des gesamten Modells?
Ich verwende glms in R (verallgemeinerte lineare Modelle). Ich dachte, ich kenne p-Werte - bis ich sah, dass das Aufrufen einer Zusammenfassung für ein glm keinen übergeordneten p-Wert ergibt, der für das gesamte Modell repräsentativ ist - zumindest nicht an der Stelle, an der lineare Modelle dies tun. Ich frage …

Durch die Nutzung unserer Website bestätigen Sie, dass Sie unsere Cookie-Richtlinie und Datenschutzrichtlinie gelesen und verstanden haben.
Licensed under cc by-sa 3.0 with attribution required.