W otoczeniu, w którym obserwujemy X1,…,XnX1,…,XnX_1,\ldots,X_n rozproszone z rozkładu o gęstości fff , zastanawiam się, czy istnieje obiektywny estymator (oparty na XiXiX_i ) odległości Hellingera do innego rozkładu o gęstości f0f0f_0 , mianowicie H(f,f0)={1−∫Xf(x)f0(x)−−−−−−−−√dx}1/2.H(f,f0)={1−∫Xf(x)f0(x)dx}1/2. \mathfrak{H}(f,f_0) = \left\{ 1 - \int_\mathcal{X} \sqrt{f(x)f_0(x)} \text{d}x \right\}^{1/2}\,.
Mam dwie populacje (mężczyzn i kobiet), z których każda zawiera próbek. Dla każdej próbki mam dwie właściwości A i B (średnia ocen w pierwszym roku i wynik SAT). Użyłem testu t oddzielnie dla A i B: oba wykryły znaczące różnice między dwiema grupami; A z i B z .p = …
Czytałem różne (pozornie) sprzeczne stwierdzenia, czy AdaBoost (lub inne techniki wspomagające) są mniej lub bardziej podatne na nadmierne dopasowanie w porównaniu do innych metod uczenia się. Czy istnieją dobre powody, by wierzyć w to jedno lub drugie? Jeśli to zależy, od czego to zależy? Jakie są powody, dla których AdaBoost …
Jestem trochę nowy w analizie danych / uczeniu maszynowym / itp. i czytałem o kilku sposobach łączenia wielu modeli i serii tego samego modelu w celu poprawy prognoz. Mam wrażenie, że po przeczytaniu kilku artykułów (często interesujących i świetnych z teorii i liter greckich, ale bez kodu i faktycznych przykładów) …
Mam dwie proporcje (np. Współczynnik klikalności (CTR) na link w układzie kontrolnym i CTR na link w układzie eksperymentalnym) i chcę obliczyć 95% przedział ufności wokół stosunku tych proporcji. Jak mam to zrobic? Wiem, że mogę użyć metody delta do obliczenia wariancji tego współczynnika, ale nie jestem pewien, co robić …
Proszę udowodnić, że jeśli mamy dwie zmienne (równa wielkość próby) i Y, a wariancja w X jest większa niż w Y , wówczas suma kwadratowych różnic (tj. Kwadratowych odległości euklidesowych) między punktami danych w X jest również większa niż że w Y .XXXYYYXXXYYYXXXYYY
Korzystam z biblioteki caretw języku R do testowania różnych procedur modelowania. trainControlObiektu pozwala na określenie metody wielokrotnego pobierania próbek. Te sposoby są opisane w dokumentacji części 2.3 i obejmują: boot, boot632, cv, LOOCV, LGOCV, repeatedcvi oob. Chociaż niektóre z nich można łatwo wywnioskować, nie wszystkie z tych metod są jasno …
Czy ktoś może doradzić, czy następujące działania mają sens: Mam do czynienia ze zwykłym modelem liniowym z 4 predyktorami. Zastanawiam się, czy porzucić najmniej znaczący termin. Jego wartość wynosi nieco ponad 0,05. Opowiedziałem się za upuszczeniem go według następujących zasad: Pomnożenie oszacowania tego terminu przez (na przykład) zakres międzykwartylowy danych …
Jest to więc dziwne dopasowanie, choć naprawdę myślę, że jest dziwne dla każdej strony, więc pomyślałem, że wypróbuję to tutaj, wśród moich braci, którzy mają problemy z danymi. Przyszłam do epidemiologii i biostatystyki z biologii i nadal zdecydowanie mam pewne nawyki z tej dziedziny. Jednym z nich jest prowadzenie zeszytu …
Czy ktoś może skierować mnie do ankiety na temat wyników „Duże , Małe n ”? Interesuje mnie, jak ten problem objawia się w różnych kontekstach badawczych, np. Regresji, klasyfikacji, teście Hotellinga itp .pppnnn
Dwa powszechne podejścia do wybierania zmiennych skorelowanych to testy istotności i walidacja krzyżowa. Jaki problem każdy z nich próbuje rozwiązać i kiedy wolałbym jeden od drugiego?
Zawsze myślałem o regresji logistycznej jako po prostu szczególnym przypadku regresji dwumianowej, w którym funkcja połączenia jest funkcją logistyczną (zamiast, powiedzmy, funkcji probit). Jednak po przeczytaniu odpowiedzi na inne pytanie brzmię, jakbym mógł się pomylić, i istnieje różnica między regresją logistyczną a regresją dwumianową z łączem logistycznym. Co za różnica?
Patrzyłem na modelowanie efektów mieszanych przy użyciu pakietu lme4 w R. Używam głównie lmerpolecenia, więc zadam pytanie poprzez kod, który używa tej składni. Przypuszczam, że ogólne łatwe pytanie może być takie: czy można porównywać dowolne dwa modele zbudowane przy lmerużyciu współczynników wiarygodności opartych na identycznych zestawach danych? Uważam, że odpowiedzią …
Mam dwa pytania dotyczące pojęcia bloku w projekcie eksperymentalnym: (1) Jaka jest różnica między blokiem a czynnikiem? (2) Próbowałem przeczytać niektóre książki, ale coś nie jest jasne: wydaje się, że autorzy zawsze zakładają, że nie ma interakcji między „czynnikiem blokującym” a innymi czynnikami. Czy to prawda, a jeśli tak, to …
Używamy plików cookie i innych technologii śledzenia w celu poprawy komfortu przeglądania naszej witryny, aby wyświetlać spersonalizowane treści i ukierunkowane reklamy, analizować ruch w naszej witrynie, i zrozumieć, skąd pochodzą nasi goście.
Kontynuując, wyrażasz zgodę na korzystanie z plików cookie i innych technologii śledzenia oraz potwierdzasz, że masz co najmniej 16 lat lub zgodę rodzica lub opiekuna.