Ich suche nach mittelgroßen bis langen Artikeln / Websites / usw. zum Thema Data Mining, insbesondere dort, wo ein Datensatz von der Datenaufbereitung bis zum endgültigen Modell eingehend untersucht wird. Ich interessiere mich besonders für Diskussionen über die Anwendung von Algen des maschinellen Lernens und auch über die grundlegende Datenmodellierung. …
Ich versuche Silver & Dunlap (1987) zu replizieren . Ich vergleiche nur die Mittelungskorrelationen oder die Mittelung der z-Transformationskorrelationen und die Rücktransformation. Ich scheine die Asymmetrie in der Verzerrung, die sie finden, nicht zu replizieren (rücktransformierte zs sind für mich nicht näher am Bevölkerungswert als rs). Irgendwelche Gedanken? Ist es …
Ich habe eine Frage, die ich der Community stellen möchte. Ich wurde kürzlich gebeten, statistische Analysen für eine Tumormarker-Prognosestudie bereitzustellen . Ich habe hauptsächlich diese beiden Referenzen verwendet, um meine Analyse zu leiten: McShane LM et al. Berichtsempfehlungen für prognostische Tumormarker-Studien (BEMERKUNG). J Natl Cancer Inst. 2005 Aug 17; 97 …
Ich verwende die Softmax-Regression für ein Klassifizierungsproblem mit mehreren Klassen. Ich habe nicht für jede Klasse die gleichen vorherigen Wahrscheinlichkeiten. Ich weiß aus der logistischen Regression (Softmax-Regression mit 2 Klassen), dass die vorherigen Wahrscheinlichkeiten der Klassen implizit zum Bias addiert werden ( log(p0/p1)log(p0/p1)\log(p_0/p_1) ). Normalerweise entferne ich diesen Begriff manuell …
Viele Lehrbücher und Papiere sagten, dass das Abfangen nicht unterdrückt werden sollte. Kürzlich habe ich einen Trainingsdatensatz verwendet, um ein lineares Regressionsmodell mit oder ohne Achsenabschnitt zu erstellen. Ich war überrascht festzustellen, dass das Modell ohne Achsenabschnitt in einem unabhängigen Validierungsdatensatz eine bessere Vorhersage als das mit einem Achsenabschnitt in …
Angenommen, wir haben Punkte in einem Rechteck mit gebundenen , und diese Punkte sind in dieser Ebene gleichmäßig verteilt. (Ich bin mit Statistiken nicht ganz vertraut, daher kenne ich den Unterschied zwischen der einheitlichen Auswahl eines Knotens im Bereich oder der einheitlichen Auswahl der Achse aus und Achse von unabhängig).nnn[0,a]×[0,b][0,a]×[0,b][0,a] …
In einigen Fällen habe ich einen Hinweis gelesen, dass Sie möglicherweise einen "Fluch der Dimensioalität" haben, wenn Sie viele Parameter und versuchen, eine "Ähnlichkeitsmetrik" zwischen diesen Vektoren zu finden. Ich glaube, es bedeutete, dass die meisten Ähnlichkeitswerte gleich sind und Ihnen keine nützlichen Informationen geben. Mit anderen Worten, fast alle …
Ich suche ein gutes Nachschlagewerk in Epidemiologie. Ich habe Rothmans Epidemiologie: Eine Einführung und Portas Ein Wörterbuch der Epidemiologie . Rothman's war eine große Enttäuschung, da es sehr simpel ist und alles fehlt, was nach dem Grundstudium nicht mehr offensichtlich ist. Ich habe gehört, dass seine moderne Epidemiologie gut ist, …
Wie verschmilzt ein Ensemble-Klassifikator die Vorhersagen seiner konstituierenden Klassifikatoren? Ich habe Schwierigkeiten, eine klare Beschreibung zu finden. In einigen Codebeispielen, die ich gefunden habe, mittelt das Ensemble nur die Vorhersagen, aber ich sehe nicht, wie dies zu einer "besseren" Gesamtgenauigkeit führen könnte. Betrachten Sie den folgenden Fall. Ein Ensemble-Klassifikator besteht …
Ich teste auf Unterschiede in einem kontinuierlichen Ergebnis unter drei verschiedenen Bedingungen. Unter der Bedingung AI wird das Ergebnis gemessen. Ich mache das zweimal für die gleiche Probe. Beispielwerte könnten 2.2, 2.1 sein. Dies sind "technische" Replikate, die aus derselben biologischen Quelle stammen Ich mache dasselbe für vier "biologische" Replikate …
Ich versuche, eine Methode zu finden, um eine bestimmte Zeitreihe programmgesteuert mit mehr als 10.000 Referenzzeitreihen zu vergleichen und die Referenzzeitreihen in die engere Wahl zu ziehen, die von Interesse sein können. Die Methode, die ich verwendete, war Pearson Correlation . Für jede der Referenzzeitreihen würde ich ihre Korrelationskoeffizienten berechnen …
Ich habe einen Satz von 20 Likert-Items (von 1-5, Stichprobengröße n = 299) im Bereich der Organisationsforschung erhalten. Die Elemente sollen ein latentes Konzept messen, das von Natur aus mehrdimensional, facettenreich und heterogen ist. Ziel ist es, eine oder mehrere Skalen zu erstellen, mit denen verschiedene Organisationen analysiert und in …
Proportions-, Verhältnis- und Prozentangaben sind in der Ökologie sehr verbreitet (z. B.% der bestäubten Blüten, Verhältnis von Männern zu Frauen,% Mortalität als Reaktion auf eine Behandlung,% der von einem Pflanzenfresser verzehrten Blätter). Kürzlich wurde von einigen angewandten Statistikern in der Zeitschrift Ecology ein Artikel mit dem Titel " Der Arkussinus …
Ich habe versucht, R für einige Längsmodelle zu verwenden, hauptsächlich über lmerund nlmePakete. Es scheint jedoch, dass viele Standardmodelle fehlen, wie beispielsweise Antedependenzmodelle oder faktoranalytische Modelle für Kovarianzmatrizen. Diese Modelle sind in SAS leicht verfügbar. Würde jemand andere Pakete für den Job in R empfehlen? Es ist mir eigentlich egal, …
We use cookies and other tracking technologies to improve your browsing experience on our website,
to show you personalized content and targeted ads, to analyze our website traffic,
and to understand where our visitors are coming from.
By continuing, you consent to our use of cookies and other tracking technologies and
affirm you're at least 16 years old or have consent from a parent or guardian.