Pytanie to jest więc nieco związane, ale starałem się, aby było to jak najbardziej proste. Cel: Krótko mówiąc, istnieje pochodna negentropii, która nie obejmuje kumulantów wyższego rzędu, i próbuję zrozumieć, w jaki sposób została wyprowadzona. Tło: (Rozumiem to wszystko) Sam studiuję książkę „Independent Component Analysis” , którą znalazłem tutaj. (To …
O'Reilly's „Machine Learning For Hackers” mówi, że każdy główny składnik reprezentuje procent wariancji. Cytowałem odpowiednią część poniższej strony (rozdział 8, s.207). W rozmowie z innym ekspertem zgodzili się, że jest to procent. Jednak 24 składniki sumują się do 133,2095%. Jak to możliwe? Przekonawszy się, że możemy korzystać z PCA, jak …
Mam dużo danych i chcę zrobić coś, co wydaje się bardzo proste. W tym dużym zestawie danych interesuje mnie, jak bardzo konkretny element zlepia się ze sobą. Powiedzmy, że moje dane są uporządkowanym zestawem w następujący sposób: {A, C, B, D, A, Z, T, C ...}. Powiedzmy, że chcę wiedzieć, …
Mam procentowe stopnie studentów na 38 egzaminach jako zmienną zależną w moim badaniu. Procent rangi jest obliczany na podstawie (rangi studenta / liczby studentów na egzaminie). Ta zmienna zależna ma prawie jednolity rozkład i chcę oszacować wpływ niektórych zmiennych na zmienną zależną. Jakiego podejścia regresji używam?
Poniższe wykresy są resztkowymi wykresami rozproszenia testu regresji, dla których z pewnością spełnione zostały już założenia dotyczące „normalności”, „homoscedastyczności” i „niezależności”! Do testowania założenia „liniowości” , chociaż patrząc na wykresy, można domyślić się, że związek jest krzywoliniowy, ale pytanie brzmi: w jaki sposób można zastosować wartość „R2 Linear” do przetestowania …
Rozumiem teoretycznie (w pewnym sensie), jak by one działały, ale nie jestem pewien, jak właściwie korzystać z metody złożonej (takiej jak głosowanie, ważone mieszanki itp.). Jakie są dobre zasoby do wdrażania metod zespołowych? Czy są jakieś szczególne zasoby dotyczące implementacji w Pythonie? EDYTOWAĆ: Aby wyjaśnić niektóre na podstawie dyskusji na …
Próbuję uruchomić Bayesa logit na dane tutaj . Używam bayesglm()w armpakiecie w R. Kodowanie jest dość proste: df = read.csv("http://dl.dropbox.com/u/1791181/bayesglm.csv", header=T) library(arm) model = bayesglm(PASS ~ SEX + HIGH, family=binomial(link="logit"), data=df) summary(model) daje następujący wynik: Coefficients: Estimate Std. Error z value Pr(>|z|) (Intercept) 0.10381 0.10240 1.014 0.311 SEXMale 0.02408 0.09363 …
Mój zespół i ja chcielibyśmy przedstawić niestatystom firmy prezentację na temat użyteczności projektowania eksperymentów. Ci statystycy są również naszymi klientami i zwykle nie konsultują się z nami przed zebraniem swoich danych. Czy znasz jakieś prawdziwe przykłady, które dobrze zilustrują słynny cytat Fishera: „Przywołanie statystyki po zakończeniu eksperymentu może być niczym …
Chciałbym wykonać test post-hoc TukeyHSD po mojej dwukierunkowej Anova z R, uzyskując tabelę zawierającą posortowane pary pogrupowane według znaczących różnic. (Przepraszam za brzmienie, wciąż jestem nowy ze statystykami). Chciałbym mieć coś takiego: Pogrupowane w gwiazdki lub litery. Dowolny pomysł? Testowałem funkcję HSD.test()z agricolaepakietu, ale wygląda na to, że nie obsługuje …
Załóżmy, że mamy zbiór punktów . Każdy punkt y i jest generowany przy użyciu rozkładu p ( y i | x ) = 1y ={ y1, y2), … , YN.}y={y1,y2,…,yN}\mathbf{y} = \{y_1, y_2, \ldots, y_N \}yjayiy_i Aby uzyskać posteriori dlaxnapisać p(x|y)αP(r|x)p(x)=t(x) N Π i=1s(Yı|X). Zgodnie z pracą Minki na tematpropagacji …
Próbuję modelować niektóre dane przy użyciu glmnetpakietu w R. Załóżmy, że mam następujące dane training_x <- data.frame(variable1 = c(1, 2, 3, 2, 3), variable2 = c(1, 2, 3, 4, 5)) y <- c(1, 2, 3, 4, 5) (Jest to uproszczenie; moje dane są znacznie bardziej skomplikowane.) Następnie użyłem następującego kodu, …
Zamknięte. To pytanie jest nie na temat . Obecnie nie przyjmuje odpowiedzi. Chcesz poprawić to pytanie? Zaktualizuj pytanie, aby było tematem dotyczącym weryfikacji krzyżowej. Zamknięte 7 lat temu . Korekta egzaminów jest prawdopodobnie najnudniejszym zadaniem nauczyciela. Ale może być zabawne, że zbieramy śmieszne odpowiedzi z egzaminów statystycznych. Jeden wpis na …
Jeśli mam określony zestaw danych, jak mądre byłoby inicjowanie centrów klastrowych przy użyciu losowych próbek tego zestawu danych? Załóżmy na przykład, że chcę 5 clusters. Przyjmuję, 5 random samplespowiedzmy, size=20%oryginalny zestaw danych. Czy mogę wziąć średnią z każdej z 5 losowych próbek i użyć tych środków jako moich 5 początkowych …
Chcę obliczyć współczynniki dla regresji, która jest bardzo podobna do regresji logistycznej (w rzeczywistości regresja logistyczna z innym współczynnikiem: gdymogą być podane). Myślałem o użyciu GMM do obliczenia współczynników, ale nie jestem pewien, jakie są obecnie warunki, których powinienem użyć.ZA1 + e- ( b0+ b1x1+ b2)x2)+ … ),A1+e−(b0+b1x1+b2x2+…), \frac{A}{1 + …
Używamy plików cookie i innych technologii śledzenia w celu poprawy komfortu przeglądania naszej witryny, aby wyświetlać spersonalizowane treści i ukierunkowane reklamy, analizować ruch w naszej witrynie, i zrozumieć, skąd pochodzą nasi goście.
Kontynuując, wyrażasz zgodę na korzystanie z plików cookie i innych technologii śledzenia oraz potwierdzasz, że masz co najmniej 16 lat lub zgodę rodzica lub opiekuna.