Zauważyłem, że podczas majstrowania przy modelu regresji wielowymiarowej zaobserwowano niewielki, ale zauważalny efekt wielokoliniowości, mierzony współczynnikami inflacji wariancji, w kategoriach zmiennej jakościowej (oczywiście po wykluczeniu kategorii odniesienia). Załóżmy na przykład, że mamy zestaw danych ze zmienną ciągłą y i jedną nominalną zmienną kategorialną x, która ma k możliwych wzajemnie wykluczających …
Próbuję zastosować ideę wzajemnej informacji do wyboru funkcji, jak opisano w tych uwagach do wykładu (na stronie 5). Moja platforma to Matlab. Jednym z problemów, które spotykam przy obliczaniu wzajemnej informacji z danych empirycznych, jest to, że liczba jest zawsze tendencyjna w górę. Znalazłem około 3 ~ 4 różnych plików …
Mam eksperyment przeprowadzany na setkach komputerów rozmieszczonych na całym świecie, który mierzy występowanie niektórych zdarzeń. Zdarzenia zależą od siebie, więc mogę uporządkować je w kolejności rosnącej, a następnie obliczyć różnicę czasu. Zdarzenia powinny być rozkładane wykładniczo, ale podczas rysowania histogramu otrzymuję to: Niedokładność zegarów na komputerach powoduje, że niektórym zdarzeniom …
Chcę zdecydować o pojemności CCC tabeli, aby miała ona szanse resztkowe mniejsze niż na przelanie dla danego , zakładając, że liczba wpisów jest zgodna z prawem Poissona z danym oczekiwana . p ∈ [ 40 … 120 ] E ∈ [ 10 3 … 10 12 ]2−p2−p2^{-p}p∈[40…120]p∈[40…120]p\in[40\dots 120]E∈[103…1012]E∈[103…1012]E\in[10^3\dots 10^{12}] Idealnie …
Podczas uczenia sparametryzowanego modelu (np. W celu zmaksymalizowania prawdopodobieństwa) za pomocą stochastycznego spadku gradientowego na niektórych zbiorach danych, powszechnie przyjmuje się, że próbki szkoleniowe są pobierane z rozkładu danych szkoleniowych. Jeśli więc celem jest modelowanie wspólnego rozkładu , to każda próbka treningowa powinna zostać pobrana z tego rozkładu.( x i …
Jak rozumiem, wykładnicza wartość beta z regresji logistycznej jest ilorazem szans tej zmiennej dla zmiennej zależnej zainteresowania. Jednak wartość nie odpowiada ręcznie obliczonemu współczynnikowi szans. Mój model przewiduje stunting (miarę niedożywienia) przy użyciu, między innymi, ubezpieczenia. // Odds ratio from LR, being done in stata logit stunting insurance age ... …
max ( X1, X2), . . . , Xn)max(X1,X2),...,Xn)\max( X_1,X_2,...,X_n) nnn∞∞\inftyσ2)σ2)\sigma^2 Jest to prawie na pewno dobrze znany problem ze sprytnym dowodem i dobrym rozwiązaniem, ale kopałem i nie znalazłem niczego.
Czytam gazetę, która to twierdzi X^k= 1N.--√∑j = 0N.- 1Xjotmi- i 2 πk j / N,X^k=1N.∑jot=0N.-1Xjotmi-ja2)πkjot/N.,\hat{X}_k=\frac{1}{\sqrt{N}}\sum_{j=0}^{N-1}X_je^{-i2\pi kj/N}, (tj. dyskretna transformata Fouriera , DFT) przez CLT ma tendencję do (złożonej) losowej zmiennej gaussowskiej. Wiem jednak, że ogólnie nie jest to prawdą. Po przeczytaniu tego (błędnego) argumentu przeszukałem sieć i znalazłem ten …
Dobrze wiadomo (np. W dziedzinie wykrywania kompresji), że norma „indukuje ” w tym sensie, że jeśli zminimalizujemy funkcjonalność (dla stałej macierzy i wektora ) dla wystarczająco dużych \ lambda> 0 , prawdopodobnie istnieje wiele opcji A , \ vec {b} , a \ lambda ma wiele dokładnie zerowych pozycji w …
Robię opisowe statystyki dziennych zwrotów z indeksów giełdowych. To jeśli i są poziomami indeksu odpowiednio w dniu 1 i dniu 2, to jest zwrotem, którego używam (całkowicie standardowe w literaturze).P 2 l o g e ( P 2P.1P1P_1P.2)P2P_2l o gmi( P2)P.1)loge(P2P1)log_e (\frac{P_2}{P_1}) Więc kurtoza jest ogromna w niektórych z nich. …
Mam dość dobre doświadczenie praktyczne z próbkowaniem Metropolis-Hastings i Gibbs, ale chcę lepiej zrozumieć matematykę tych algorytmów. Jakie są dobre podręczniki lub artykuły, które dowodzą poprawności tych samplerów (więcej algorytmów też byłoby świetnych)?
Rozważ kontekst klastrowania dendrogramu. Nazwijmy pierwotne odmienności odległościami między jednostkami. Po skonstruowaniu dendrogramu definiujemy khenetyczną odmienność między dwoma osobami jako odległość między skupieniami, do których te osoby należą. Niektóre osoby uważają, że korelacja między pierwotnymi odmiennościami a kopenetycznymi odmiennościami (zwana korelacją kopenetyczną ) jest „wskaźnikiem przydatności” klasyfikacji. Brzmi dla mnie …
Używamy plików cookie i innych technologii śledzenia w celu poprawy komfortu przeglądania naszej witryny, aby wyświetlać spersonalizowane treści i ukierunkowane reklamy, analizować ruch w naszej witrynie, i zrozumieć, skąd pochodzą nasi goście.
Kontynuując, wyrażasz zgodę na korzystanie z plików cookie i innych technologii śledzenia oraz potwierdzasz, że masz co najmniej 16 lat lub zgodę rodzica lub opiekuna.