Statystyki i duże zbiory danych

Pytania i odpowiedzi dla osób zainteresowanych statystyką, uczeniem maszynowym, analizą danych, eksploracją danych i wizualizacją danych

2
Przejrzyste wyjaśnienie „stabilności numerycznej inwersji macierzy” w regresji grzbietu i jej roli w zmniejszaniu przeładowania
Rozumiem, że możemy zastosować regularyzację w przypadku problemu regresji metodą najmniejszych kwadratów jako w∗=argminw[(y−Xw)T(y−Xw)+λ∥w∥2]w∗=argminw⁡[(y−Xw)T(y−Xw)+λ‖w‖2]\boldsymbol{w}^* = \operatorname*{argmin}_w \left[ (\mathbf y-\mathbf{Xw})^T(\boldsymbol{y}-\mathbf{Xw}) + \lambda\|\boldsymbol{w}\|^2 \right] i że ten problem ma rozwiązanie zamknięte, ponieważ: w^=(XTX+λI)−1XTy.w^=(XTX+λI)−1XTy.\hat{\boldsymbol{w}} = (\boldsymbol{X}^T\boldsymbol{X}+\lambda\boldsymbol{I})^{-1}\boldsymbol{X}^T\boldsymbol{y}. Widzimy, że w drugim równaniu regularyzacja po prostu dodaje λλ\lambda do przekątnej XTXXTX\boldsymbol{X}^T\boldsymbol{X} , co ma na …

3
Twierdzenie o granicy centralnej i rozkład Pareto
Czy ktoś może przedstawić proste (świeckie) wyjaśnienie związku między rozkładami Pareto a centralnym twierdzeniem granicznym (np. Czy ma zastosowanie? Dlaczego / dlaczego nie?)? Próbuję zrozumieć następujące oświadczenie: „Twierdzenie o granicy centralnej nie działa z każdym rozkładem. Wynika to z jednego podstępnego faktu - średnie próbki są skupione wokół średniej rozkładu …

1
Czy istnieją aplikacje, w których SVM wciąż jest lepszy?
Algorytm SVM jest dość stary - opracowano go w latach 60., ale był niezwykle popularny w latach 90. i 2000. Jest to klasyczna (i dość piękna) część kursów uczenia maszynowego. Dziś wydaje się, że w przetwarzaniu mediów (obrazy, dźwięk itp.) Sieci neuronowe całkowicie dominują, podczas gdy w innych obszarach wzmocnienie …


1
Pozorna niezgodność źródeł w analizie liniowej, kwadratowej i dyskryminacyjnej Fishera
Studiuję analizę dyskryminacyjną, ale trudno mi pogodzić kilka różnych wyjaśnień. Wydaje mi się, że czegoś mi brakuje, ponieważ nigdy wcześniej nie spotkałem się z takim (pozornym) poziomem rozbieżności. Biorąc to pod uwagę, liczba pytań dotyczących analizy dyskryminacyjnej na tej stronie wydaje się świadczyć o jej złożoności. LDA i QDA dla …

1
Jak narysować dopasowany wykres i rzeczywisty wykres rozkładu gamma na jednym wykresie?
Załaduj potrzebny pakiet. library(ggplot2) library(MASS) Wygeneruj 10 000 liczb dopasowanych do rozkładu gamma. x <- round(rgamma(100000,shape = 2,rate = 0.2),1) x <- x[which(x>0)] Narysuj funkcję gęstości prawdopodobieństwa, zakładając, że nie wiemy, do którego rozkładu x pasuje. t1 <- as.data.frame(table(x)) names(t1) <- c("x","y") t1 <- transform(t1,x=as.numeric(as.character(x))) t1$y <- t1$y/sum(t1[,2]) ggplot() + …

2
Jak próbkować z dyskretnego rozkładu na liczbach całkowitych nieujemnych?
Mam następujący dyskretny rozkład, w którym są znanymi stałymi:α , βα,β\alpha,\beta p ( x ; α , β) =Beta ( α + 1 , β+ x )Beta ( α , β)dla x = 0 , 1 , 2 , …p(x;α,β)=Beta(α+1,β+x)Beta(α,β)dla x=0,1,2),… p(x;\alpha,\beta) = \frac{\text{Beta}(\alpha+1, \beta+x)}{\text{Beta}(\alpha,\beta)} \;\;\;\;\text{for } x = 0,1,2,\dots …

3
Randomizacja próby losowej
Zawsze jestem nieco zaskoczony, widząc reklamy psychologiczne za udział w badaniach eksperymentalnych. Z pewnością ludzie, którzy reagują na te reklamy, nie są losowo wybierani, a zatem stanowią populację wybraną przez siebie. Ponieważ wiadomo, że randomizacja rozwiązuje problem samoselekcji, zastanawiałem się, czy randomizacja próbki nieprzypadkowej rzeczywiście coś zmieniła. Co myślisz ? …

1
Na jakie pytanie odpowiada ANOVA?
Chcę nauczyć się ANOVA. Zanim zacznę się uczyć, jak działa algorytm (jakie obliczenia należy wykonać) i dlaczego działa, najpierw chciałbym wiedzieć, jaki problem rozwiązujemy za pomocą ANOVA lub jaką odpowiedź próbujemy odpowiedzieć. Innymi słowy: co to jest dane wejściowe i dane wyjściowe algorytmu? Rozumiem, co wykorzystujemy jako wkład. Mamy zestaw …
10 anova 

3
Struktura rekurencyjnej sieci neuronowej (LSTM, GRU)
Próbuję zrozumieć architekturę RNN. Znalazłem ten samouczek, który był bardzo pomocny: http://colah.github.io/posts/2015-08-Understanding-LSTMs/ Zwłaszcza ten obraz: Jak to pasuje do sieci feed-forward? Czy ten obraz jest po prostu innym węzłem w każdej warstwie?


2
Liczba pojemników podczas obliczania wzajemnych informacji
Chcę kwantyfikować związek między dwiema zmiennymi, A i B, wykorzystując wzajemne informacje. Można to obliczyć, dzieląc obserwacje (patrz przykładowy kod Python poniżej). Jednak jakie czynniki determinują, jaka liczba pojemników jest rozsądna? Potrzebuję szybkiego obliczenia, więc nie mogę po prostu użyć wielu pojemników, aby zachować bezpieczeństwo. from sklearn.metrics import mutual_info_score def …

2
Dokładnie w jaki sposób coxph () R radzi sobie z powtarzanymi taktami?
Kontekst Próbuję zrozumieć, w jaki sposób Rxx () przyjmuje i obsługuje powtarzające się wpisy dla podmiotów (lub pacjenta / klienta, jeśli wolisz). Niektórzy nazywają to długim formatem, inni nazywają to „powtarzanymi pomiarami”. Zobacz na przykład zestaw danych zawierający kolumnę identyfikatora w sekcji Odpowiedzi na: Najlepsze pakiety dla modeli Coxa z …

1
Wykorzystanie mediany do obliczania wariancji
Mam losową zmienną 1-D, która jest niezwykle wypaczona. Aby znormalizować ten rozkład, chcę raczej użyć mediany niż średniej. moje pytanie brzmi: czy mogę obliczyć wariancję rozkładu przy użyciu mediany we wzorze zamiast średniej? tzn. czy mogę wymienić V a r (X) = ∑ [ (Xja- m e a n ( …
10 variance  mean  median 


Korzystając z naszej strony potwierdzasz, że przeczytałeś(-aś) i rozumiesz nasze zasady używania plików cookie i zasady ochrony prywatności.
Licensed under cc by-sa 3.0 with attribution required.