Statystyki i duże zbiory danych

Pytania i odpowiedzi dla osób zainteresowanych statystyką, uczeniem maszynowym, analizą danych, eksploracją danych i wizualizacją danych

2
Kiedy MCMC stało się powszechne?
Czy ktoś wie, w którym roku MCMC stało się powszechne (tj. Popularna metoda wnioskowania bayesowskiego)? Szczególnie pomocny byłby link do liczby opublikowanych artykułów MCMC (czasopism) w czasie.
19 bayesian  mcmc  history 

1
Dlaczego stosowanie metody Newtona do optymalizacji regresji logistycznej nazywa się iteracyjną, ponownie ważoną metodą najmniejszych kwadratów?
Dlaczego stosowanie metody Newtona do optymalizacji regresji logistycznej nazywa się iteracyjną, ponownie ważoną metodą najmniejszych kwadratów? Nie wydaje mi się to jasne, ponieważ utrata logistyczna i utrata najmniejszych kwadratów to zupełnie inne rzeczy.

2
Dlaczego konieczne jest pobieranie próbek z rozkładu tylnego, jeśli już WIEMY rozkład tylny?
Rozumiem, że stosując podejście bayesowskie do szacowania wartości parametrów: Rozkład tylny jest kombinacją rozkładu wcześniejszego i rozkładu prawdopodobieństwa. Symulujemy to, generując próbkę z rozkładu tylnego (np. Przy użyciu algorytmu Metropolis-Hasting do generowania wartości i akceptujemy je, jeśli przekraczają pewien próg prawdopodobieństwa przynależności do rozkładu tylnego). Po wygenerowaniu tej próbki używamy …

6
Warstwy splotowe: do padania czy nie?
Architektura AlexNet korzysta z wypełnień zerowych, jak pokazano na rysunku: W artykule nie ma jednak wyjaśnienia, dlaczego wprowadzono to wypełnienie. Kurs Standford CS 231n uczy, że używamy paddingu, aby zachować rozmiar przestrzenny: Zastanawiam się, czy to jedyny powód, dla którego potrzebujemy wypełnienia? Mam na myśli, że jeśli nie muszę zachowywać …

4
Czy w przypadku danych kategorycznych mogą istnieć klastry bez powiązanych zmiennych?
Próbując wyjaśnić analizy skupień, ludzie często błędnie rozumieją ten proces jako związany z korelacją zmiennych. Jednym ze sposobów na ominięcie tego zamieszania jest taki spisek: To wyraźnie pokazuje różnicę między pytaniem, czy istnieją klastry, a pytaniem, czy zmienne są powiązane. Ilustruje to jednak tylko rozróżnienie dla ciągłych danych. Mam problem …



2
Czy test t-Studenta jest testem Walda?
Czy test t-Studenta jest testem Walda? Przeczytałem opis testów Walda z All Statistics Wassermana . Wydaje mi się, że test Walda obejmuje testy t. Czy to jest poprawne? Jeśli nie, to co powoduje, że test t nie jest testem Walda?


1
Po co w ogóle stosować ANOVA zamiast skakać bezpośrednio do post-hoc lub planowanych testów porównawczych?
Patrząc na sytuację ANOVA między grupami, co otrzymujesz, wykonując najpierw taki test ANOVA, a następnie post-hoc (Bonferroni, Šidák itp.) Lub planowane testy porównawcze? Dlaczego nie pominąć całkowicie kroku ANOVA? Wydaje mi się, że w takiej sytuacji jedyną korzyścią ANOVA między grupami jest możliwość zastosowania HSD Tukeya jako testu post hoc. …

2
Jaka jest intuicja odwracalnego procesu w szeregach czasowych?
Czytam książkę o szeregach czasowych i zacząłem drapać się w głowę w następującej części: Czy ktoś mógłby wyjaśnić mi intuicję? Nie mogłem tego uzyskać z tego tekstu. Dlaczego potrzebujemy, aby proces był odwracalny? Jaki jest tutaj duży obraz? Dziękuję za wszelką pomoc. Jestem nowy w tej kwestii, więc jeśli możesz …
19 time-series  arma 



1
Dobroć dopasowania do histogramów 2D
Mam dwa zestawy danych reprezentujących parametry gwiazd: obserwowany i modelowany. Za pomocą tych zestawów tworzę tak zwany schemat dwukolorowy (TCD). Próbkę można zobaczyć tutaj: Być obserwowane dane i B dane wydobyte z modelu (nieważne czarne linie, kropki reprezentują dane) Mam tylko jedno A schemat, ale może produkować tyle różnych B …


Korzystając z naszej strony potwierdzasz, że przeczytałeś(-aś) i rozumiesz nasze zasady używania plików cookie i zasady ochrony prywatności.
Licensed under cc by-sa 3.0 with attribution required.