Statystyki i duże zbiory danych

Pytania i odpowiedzi dla osób zainteresowanych statystyką, uczeniem maszynowym, analizą danych, eksploracją danych i wizualizacją danych

1
"Od
Krótkie pytanie: dlaczego to prawda? Długie pytanie: Po prostu staram się dowiedzieć, co uzasadnia to pierwsze równanie. Autor książki, którą czytam (w kontekście , jeśli chcesz, ale niekoniecznie), twierdzi, co następuje: Z powodu założenia bliskiego gaussowskości możemy napisać: p0(ξ)=Aϕ(ξ)exp(an+1ξ+(an+2+12)ξ2+∑i=1naiGi(ξ))p0(ξ)=Aϕ(ξ)exp(an+1ξ+(an+2+12)ξ2+∑i=1naiGi(ξ)) p_0(\xi) = A \; \phi(\xi) \; exp( a_{n+1}\xi + (a_{n+2} + …

1
Parametryzacja rozkładów Behrensa – Fishera
„O problemie Behrensa – Fishera: przegląd” Seock-Ho Kim i Allena S. Cohena Journal of Educational and Behavioral Statistics , tom 23, nr 4, Winter, 1998, strony 356–377 Patrzę na to i mówi: Fisher (1935, 1939) wybrał statystykę [gdzie jest zwykłą -statystyczną próbką dla ] gdzie jest pobierane w pierwszej ćwiartce, …



2
Dynamiczne dostosowywanie architektury NN: wymyślanie niepotrzebnego?
Zaczynam od podróży doktorskiej, a ostatecznym celem, jaki sobie wyznaczyłem, jest opracowanie ANN, które monitorowałyby środowisko, w którym pracują, i dynamicznie dostosowywały swoją architekturę do problemu. Oczywistą konsekwencją jest czasowość danych: jeśli zbiór danych nie jest ciągły i nie zmienia się z czasem, po co w ogóle się dostosowywać? Najważniejsze …

2
Gdzie mogę znaleźć zestawy danych przydatne do testowania własnych wdrożeń uczenia maszynowego? [Zamknięte]
Zamknięte. To pytanie jest nie na temat . Obecnie nie przyjmuje odpowiedzi. Chcesz poprawić to pytanie? Zaktualizuj pytanie, aby było tematem dotyczącym weryfikacji krzyżowej. Zamknięte 6 lat temu . Obecnie próbuję samodzielnie wdrożyć niektóre algorytmy uczenia maszynowego. Wiele z nich ma tę nieprzyjemną właściwość, że jest trudna do debugowania, niektóre …
9 dataset 



2
Niektóre z moich predyktorów są w bardzo różnych skalach - czy muszę je przekształcić przed dopasowaniem modelu regresji liniowej?
Chciałbym uruchomić regresję liniową na wielowymiarowym zestawie danych. Istnieją różnice między różnymi wymiarami pod względem ich wielkości. Na przykład wymiar 1 ogólnie ma zakres wartości [0, 1], a wymiar 2 ma zakres wartości [0, 1000]. Czy muszę wykonać transformację, aby zakresy danych dla różnych wymiarów były w tej samej skali? …

2
Jak wygenerować wykres podobny do wykresu wygenerowanego przez plot.bugs i plot.jags z mcmc.list? [Zamknięte]
Zamknięte. To pytanie jest nie na temat . Obecnie nie przyjmuje odpowiedzi. Chcesz poprawić to pytanie? Zaktualizuj pytanie, aby było tematem dotyczącym weryfikacji krzyżowej. Zamknięte 2 lata temu . R wydaje się być w stanie generować ładne wykresy podsumowań z obiektów bugsi jagsgenerowanych przez funkcje R2WinBUGS :: bugs i R2jags: …


1
Model proporcjonalnego hazardu Coxa i interpretacja współczynników, gdy występuje interakcja wyższych przypadków
Oto podsumowanie wyników modelu Coxpha, którego użyłem (użyłem R, a wynik jest oparty na najlepszym modelu końcowym, tj. Uwzględniono wszystkie istotne zmienne objaśniające i ich interakcje): coxph(formula = Y ~ LT + Food + Temp2 + LT:Food + LT:Temp2 + Food:Temp2 + LT:Food:Temp2) # Y<-Surv(Time,Status==1) n = 555 coef exp(coef) …

1
Modelowanie trendu przestrzennego za pomocą regresji za pomocą
Planuję uwzględnić współrzędne jako współzmienne w równaniu regresji, aby dostosować się do trendu przestrzennego występującego w danych. Następnie chcę przetestować resztki na autokorelacji przestrzennej w losowej odmianie. Mam kilka pytań: Powinienem wykonać regresję liniową, w której są tylko zmienne niezależne xxx i yyy współrzędne, a następnie testowanie reszt na autokorelacji …

1
Problemy z badaniem symulacyjnym powtórzonych eksperymentów z wyjaśnieniem 95% przedziału ufności - gdzie się mylę?
Próbuję napisać skrypt R, aby zasymulować interpretację powtarzanych eksperymentów z 95% przedziałem ufności. Przekonałem się, że przecenia on odsetek przypadków, w których prawdziwa wartość populacyjna części jest zawarta w 95% CI próby. Niewielka różnica - około 96% vs 95%, ale to mnie jednak zainteresowało. Moja funkcja pobiera próbkę samp_nz rozkładu …


Korzystając z naszej strony potwierdzasz, że przeczytałeś(-aś) i rozumiesz nasze zasady używania plików cookie i zasady ochrony prywatności.
Licensed under cc by-sa 3.0 with attribution required.