Statistiken und Big Data

Fragen und Antworten für Personen, die sich für Statistik, maschinelles Lernen, Datenanalyse, Data Mining und Datenvisualisierung interessieren

2
Führen Entscheidungsbäume eine Aufteilung von Knoten durch, indem sie in der Praxis kategoriale Werte in numerische Werte konvertieren?
Verwenden wir in Entscheidungsbäumen bei der Klassifizierung oder Regression nur numerische Werte? Angenommen, ich habe eine kategoriale Spalte Windals Feature. Angenommen , ich habe am 5 Zeilen (Beobachtungen) und die Werte für Windsind [ high, low, high, medium, medium]. Kann ich diese kategorialen Daten in einen Entscheidungsbaumklassifikator (wie scikit-learn) einspeisen, …


1
Unterschied zwischen Naive Bayes und Recurrent Neural Network (LSTM)
Ich möchte eine Stimmungsanalyse für Text durchführen, habe mehrere Artikel durchgesehen, einige verwenden "Naive Bayes" und andere sind "Recurrent Neural Network (LSTM)" , andererseits habe ich eine Python-Bibliothek für die Stimmungsanalyse gesehen, die ist nltk. Es verwendet "Naive Bayes". Kann jemand erklären, was der Unterschied zwischen der Verwendung der beiden …

4
Wurm und Apple erwarteter Wert
Ein Apfel ist am Scheitelpunkt befindet von Fünfeck , und eine Schnecke ist , zwei Ecken entfernt, auf . Jeden Tag kriecht der Wurm mit gleicher Wahrscheinlichkeit zu einem der beiden benachbarten Eckpunkte. Somit befindet sich der Wurm nach einem Tag am Scheitelpunkt oder mit einer Wahrscheinlichkeit von jeweils . …

3
Normalverteilung
Es gibt ein Statistikproblem, bei dem ich leider keine Ahnung habe, wo ich anfangen soll (ich lerne alleine, daher kann ich niemanden fragen, ob ich etwas nicht verstehe. Die Frage ist N ( a , b 2 ) ; a = 0 ; b 2 = 6 ; v a …

2
Warum hat dieser Datensatz keine Kovarianz?
Mein Verständnis der Funktionsweise der Kovarianz ist, dass korrelierte Daten eine etwas hohe Kovarianz aufweisen sollten. Ich bin auf eine Situation gestoßen, in der meine Daten korreliert aussehen (wie im Streudiagramm gezeigt), die Kovarianz jedoch nahe Null liegt. Wie kann die Kovarianz der Daten Null sein, wenn sie korreliert sind? …





1
Begrenzung der Verteilung von
Sei (Xn)(Xn)(X_n) eine Folge von iid N(0,1)N(0,1)\mathcal N(0,1) Zufallsvariablen. Definiere S0=0S0=0S_0=0 und Sn=∑nk=1XkSn=∑k=1nXkS_n=\sum_{k=1}^n X_k für n≥1n≥1n\geq 1 . Finden Sie die Grenzverteilung von 1n∑k=1n|Sk−1|(X2k−1)1n∑k=1n|Sk−1|(Xk2−1)\frac1n \sum_{k=1}^{n}|S_{k-1}|(X_k^2 - 1) Dieses Problem stammt aus einem Problembuch zur Wahrscheinlichkeitstheorie im Kapitel über den zentralen Grenzwertsatz. Da Sk−1Sk−1S_{k-1} und XkXkX_k unabhängig sind, ist E(|Sk−1|(X2k−1))=0E(|Sk−1|(Xk2−1))=0E(|S_{k-1}|(X_k^2 - …



1
Wie schreibe ich das elastische Netz richtig?
Ich bin verwirrt über die richtige Art, das elastische Netz zu schreiben. Nach dem Lesen einiger Forschungsarbeiten scheint es drei Formen zu geben 1)exp{ - λ1| βk| - λ2β2k}}exp⁡{- -λ1|βk|- -λ2βk2}}\exp\{-\lambda_1|\beta_k|-\lambda_2\beta_k^2\} 2)exp{ - ( λ1| βk| + λ2β2k)σ2√}}exp⁡{- -(λ1|βk|+λ2βk2)σ2}}\exp\{-\frac{(\lambda_1|\beta_k|+\lambda_2\beta_k^2)}{\sqrt{\sigma^2}}\} 3)exp{ - ( λ1| βk| + λ2β2k)2 σ2}}exp⁡{- -(λ1|βk|+λ2βk2)2σ2}}\exp\{-\frac{(\lambda_1|\beta_k|+\lambda_2\beta_k^2)}{2\sigma^2}\} Ich verstehe …


Durch die Nutzung unserer Website bestätigen Sie, dass Sie unsere Cookie-Richtlinie und Datenschutzrichtlinie gelesen und verstanden haben.
Licensed under cc by-sa 3.0 with attribution required.