Statystyki i duże zbiory danych

Pytania i odpowiedzi dla osób zainteresowanych statystyką, uczeniem maszynowym, analizą danych, eksploracją danych i wizualizacją danych


1
Hipoteza zerowa równoważności
Załóżmy że są prostą losową próbką z rozkładu Normal .X1,X2,...,XnX1,X2,...,XnX_1, X_2, \, ... \, , X_n(μ,σ2)(μ,σ2)(\mu,\sigma^2) Jestem zainteresowany przeprowadzeniem następującego testu hipotez: dla danej stałej .H0:|μ|≤cH1:|μ|>c,H0:|μ|≤cH1:|μ|>c, H_0: | \mu| \le c \\ H_1: |\mu| > c, c>0c>0c > 0 Myślałem o przeprowadzeniu dwóch jednostronnych testów (TOST) w analogiczny sposób, jak …

1
Neg Binomial i przeor Jeffreysa
Próbuję uzyskać wcześniejszy Jeffreys dla ujemnego rozkładu dwumianowego. Nie widzę, gdzie się mylę, więc jeśli ktoś mógłby pomóc to wskazać, byłoby to mile widziane. Okej, więc sytuacja jest następująca: mam porównać wcześniejsze rozkłady uzyskane za pomocą dwumianu i ujemnego dwumianu, gdzie (w obu przypadkach) jest prób i m sukcesów. Otrzymuję …

2
Czy mogę zawrzeć wielkość efektu jako zmienną niezależną w meta-regresji?
Moje pytanie brzmi, czy mogę użyć wielkości efektu XXX jako zmiennej zależnej i innej wielkości efektu YYY jako zmiennej niezależnej w meta-regresji? Na przykład przeprowadziłem metaanalizę wpływu ćwiczeń fizycznych na problemy z piciem i znalazłem znaczące wyniki i wysoką niejednorodność. Chcę wykonać meta-regresję i wykorzystać wielkość efektu tych interwencji w …


2
Czy w tym podejściu do modelowania występuje zbyt duże dopasowanie?
Niedawno powiedziano mi, że proces, który podjąłem (element pracy magisterskiej) może być postrzegany jako nadmierny. Chcę lepiej to zrozumieć i sprawdzić, czy inni się z tym zgadzają. Celem tej części artykułu jest Porównaj wydajność drzew regresji wzmocnionej gradientem z losowymi lasami na zbiorze danych. Spójrz na wydajność wybranego ostatecznego modelu …

4
Bayesowskie nieinformacyjne priory kontra częste hipotezy zerowe: jaki jest związek?
Natrafiłem na to zdjęcie w blogu tutaj . Byłem rozczarowany, że czytanie oświadczenia nie wywołało u mnie takiego samego wyrazu twarzy, jak u tego faceta. Co zatem oznacza stwierdzenie, że hipoteza zerowa jest tym, w jaki sposób częstokształtni wyrażają nieinformacyjny przeor? Czy to naprawdę prawda? Edycja: Mam nadzieję, że ktoś …

8
Wizualizacja danych wielowymiarowych
Mam próbki dwóch klas, które są wektorami w przestrzeni wielowymiarowej i chcę je narysować w 2D lub 3D. Wiem o technikach zmniejszania wymiarów, ale potrzebuję naprawdę prostego i łatwego w użyciu narzędzia (w Matlabie, Pythonie lub wcześniej .exe). Zastanawiam się też, czy reprezentacja w 2D będzie „znacząca”? (Na przykład, jak …

1
Macierz kowariancji dla procesu Gaussa i rozkładu Wishart
Czytam ten artykuł na temat ogólnych procesów Wishart (GWP). Artykuł oblicza kowariancje między różnymi zmiennymi losowymi (zgodnie z procesem Gaussa ) za pomocą kwadratowej funkcji kowariancji wykładniczej, tj. . Następnie mówi, że ta macierz kowariancji jest zgodna z GWP.K(x,x′)=exp(−|(x−x′)|22l2)K(x,x′)=exp⁡(−|(x−x′)|22l2)K(x,x') = \exp\left(-\frac{|(x-x')|^2}{2l^2}\right) Kiedyś myślałem, że macierz kowariancji obliczona z liniowej funkcji …


8
Jakie oprogramowanie statystyczne nadaje się do nauczania licencjackich wstępnych kursów statystyki w naukach społecznych?
Szukam pakietu oprogramowania statystycznego, którego mogę użyć we wprowadzającym kursie do programu badań nauk społecznych. Studenci nie mają wcześniejszej wiedzy statystycznej ani doświadczenia w językach programowania. Celem jest zapoznanie ich z podstawowymi pojęciami statystycznymi (jako średnie, wariancja, suma kwadratów, wartości p, ... i wreszcie regresja liniowa) oraz umożliwienie im samodzielnego …


1
Intuicyjne rozumienie kowariancji, kowariancji krzyżowej, autokorelacji / korelacji krzyżowej i gęstości widma mocy
Obecnie studiuję do moich finałów w podstawowych statystykach dla mojego licencjata ECE. Chociaż wydaje mi się, że mam matematykę głównie słabo, brakuje mi intuicyjnego zrozumienia, co tak naprawdę oznaczają liczby (preambuła: użyję raczej niechlujnego języka). Wiem, że E [X] jest „średnią ważoną” wszystkich wyników X ważonych ich prawdopodobieństwem. Opcja Var …

5
Co zrobić ze zmiennymi współliniowymi
Oświadczenie: To jest praca domowa. Próbuję znaleźć najlepszy model dla cen diamentów, w zależności od kilku zmiennych i wydaje mi się, że mam do tej pory całkiem niezły model. Natknąłem się jednak na dwie zmienne, które są oczywiście współliniowe: >with(diamonds, cor(data.frame(Table, Depth, Carat.Weight))) Table Depth Carat.Weight Table 1.00000000 -0.41035485 0.05237998 …

2
Interpretacja wykresu QQ
Rozważ następujący kod i wynik: par(mfrow=c(3,2)) # generate random data from weibull distribution x = rweibull(20, 8, 2) # Quantile-Quantile Plot for different distributions qqPlot(x, "log-normal") qqPlot(x, "normal") qqPlot(x, "exponential", DB = TRUE) qqPlot(x, "cauchy") qqPlot(x, "weibull") qqPlot(x, "logistic") Wydaje się, że wykres QQ dla log-normal jest prawie taki sam …

Korzystając z naszej strony potwierdzasz, że przeczytałeś(-aś) i rozumiesz nasze zasady używania plików cookie i zasady ochrony prywatności.
Licensed under cc by-sa 3.0 with attribution required.