Chciałbym badać rzadkie zdarzenia w ograniczonej populacji. Ponieważ nie jestem pewien, która strategia najlepiej się nadaje, byłbym wdzięczny za wskazówki i referencje związane z tą kwestią, chociaż jestem świadomy, że została w dużej mierze uwzględniona. Po prostu nie wiem od czego zacząć. Mój problem dotyczy nauk politycznych i mam skończoną …
Czy ktoś może mi powiedzieć różnicę między jądrami w SVM: Liniowy Wielomian Gaussowski (RBF) Sigmoid Ponieważ, jak wiemy, jądro służy do mapowania naszej przestrzeni wejściowej na przestrzeń cech o wysokiej wymiarowości. I w tej przestrzeni cech znajdujemy liniowo oddzielalną granicę. Kiedy są używane (pod jakim warunkiem) i dlaczego?
Czytałem dziś o klasyfikacji Naive Bayes. Przeczytałem pod nagłówkiem Szacowanie parametrów z dodaniem 1 wygładzania : Niech odnosi się do klasy (takiej jak Pozytywna lub Negatywna), a niech odnosi się do tokena lub słowa.cccwww Estymator największego prawdopodobieństwa dla wynosiP(w|c)P(w|c)P(w|c)count(w,c)count(c)=counts w in class ccounts of words in class c.count(w,c)count(c)=counts w in …
Jeśli i są dwoma niezależnymi wektorami jednostek losowych w (równomiernie rozmieszczonymi na kuli jednostkowej), jaki jest rozkład ich iloczynu skalarnego (iloczyn skalarny) ?xx\mathbf{x}yy\mathbf{y}RreRD\mathbb{R}^Dx ⋅ yx⋅y\mathbf x \cdot \mathbf y Wydaje mi się, że gdy szybko rośnie rozkład (?) Staje się normalny z zerową średnią i wariancją malejącą w wyższych wymiarach …
Obserwuję moje pytanie tutaj , zastanawiam się, czy istnieją silne poglądy za czy przeciw wykorzystaniu odchylenia standardowego do wykrycia przekroczeń (np dowolny DATAPOINT że jest więcej niż 2 Odchylenie standardowe jest poboczna). Wiem, że zależy to od kontekstu badania, na przykład punkt danych, 48 kg, z pewnością będzie wartością odstającą …
W algorytmie Losowy las Breiman (autor) konstruuje macierz podobieństwa w następujący sposób: Wyślij wszystkie przykłady uczenia się w dół każdego drzewa w lesie Jeśli dwa przykłady wylądują w tym samym przyrostu liścia, odpowiedni element w macierzy podobieństwa o 1 Normalizuj matrycę z liczbą drzew On mówi: Bliskości między przypadkami n …
Częstym etapem wstępnego przetwarzania algorytmów uczenia maszynowego jest wybielanie danych. Wydaje się, że zawsze dobrze jest wybielić, ponieważ dekoreluje dane, co ułatwia modelowanie. Kiedy wybielanie nie jest zalecane? Uwaga: mam na myśli dekorelację danych.
Korzystam z GEE na 3-poziomowych niezrównoważonych danych, używając łącza logit. Czym to się różni (pod względem wniosków, które mogę wyciągnąć i znaczenia współczynników) od GLM z efektami mieszanymi (GLMM) i linkiem logit? Więcej szczegółów: Obserwacje są pojedynczymi próbami bernoulli. Są one pogrupowane w klasy i szkoły. Za pomocą R. Przypadkowe …
Walidacja krzyżowa K-krotnie może być wykorzystana do oszacowania możliwości generalizacji danego klasyfikatora. Czy mogę (lub powinienem) również obliczyć wariancję zbiorczą ze wszystkich przebiegów sprawdzania poprawności, aby uzyskać lepsze oszacowanie jej wariancji? Jeśli nie to dlaczego? Znalazłem artykuły, które wykorzystują połączone odchylenie standardowe w wielu testach krzyżowych . Znalazłem także artykuły …
Nauczyłem się, że muszę testować normalność nie na surowych danych, ale na ich pozostałościach. Czy powinienem obliczyć pozostałości, a następnie wykonać test W Shapiro – Wilka? Czy reszty są obliczane jako: ?Xja- znaczyXja-oznaczaćX_i - \text{mean} Zobacz moje poprzednie pytanie dotyczące moich danych i projektu.
Zastanawiam się, czy istnieje prosty sposób na utworzenie listy zmiennych za pomocą pętli for i podanie jej wartości. for(i in 1:3) { noquote(paste("a",i,sep=""))=i } W powyższym kodzie, staram się tworzyć a1, a2, a3, które przypisać do wartości 1, 2, 3. Jednakże R daje komunikat o błędzie. Dzięki za pomoc.
Czy jest 99 percentyli, czy 100 percentyli? I czy są to grupy liczb, linie podziału, czy wskaźniki do poszczególnych liczb? Przypuszczam, że to samo pytanie dotyczy kwartyli lub dowolnego kwantyla. Czytałem, że indeks liczby dla określonego percentyla (p), dla n elementów, wynosi i = (p / 100) * n To …
Dziwię się, że nie zadawano tego wcześniej, ale nie mogę znaleźć pytania na stats.stackexchange. Oto wzór na obliczenie wariancji normalnie rozłożonej próbki: ∑(X−X¯)2n−1∑(X−X¯)2n−1\frac{\sum(X - \bar{X}) ^2}{n-1} Oto wzór na obliczenie średniego błędu kwadratu obserwacji w prostej regresji liniowej: ∑(yi−y^i)2n−2∑(yi−y^i)2n−2\frac{\sum(y_i - \hat{y}_i) ^2}{n-2} Jaka jest różnica między tymi dwiema formułami? Jedyną …
Czy ktoś może mi powiedzieć, jak ocenić, czy nadzorowany model uczenia maszynowego jest zbyt dobry, czy nie? Jeśli nie mam zewnętrznego zestawu danych do sprawdzania poprawności, chcę wiedzieć, czy mogę użyć ROC 10-krotnego sprawdzania poprawności krzyżowej w celu wyjaśnienia nadmiernego dopasowania. Jeśli mam zewnętrzny zestaw danych do sprawdzania poprawności, co …
Jaka jest różnica między testem Kwiatkowski – Phillips – Schmidt – Shin (KPSS) a rozszerzonym testem Dickeya-Fullera (ADF)? Czy testują to samo? Czy też musimy ich używać w różnych sytuacjach?
Używamy plików cookie i innych technologii śledzenia w celu poprawy komfortu przeglądania naszej witryny, aby wyświetlać spersonalizowane treści i ukierunkowane reklamy, analizować ruch w naszej witrynie, i zrozumieć, skąd pochodzą nasi goście.
Kontynuując, wyrażasz zgodę na korzystanie z plików cookie i innych technologii śledzenia oraz potwierdzasz, że masz co najmniej 16 lat lub zgodę rodzica lub opiekuna.