Statystyki i duże zbiory danych

Pytania i odpowiedzi dla osób zainteresowanych statystyką, uczeniem maszynowym, analizą danych, eksploracją danych i wizualizacją danych

2
Wiarygodność trybu z próbki MCMC
W swojej książce Doing Bayesian Data Analysis John Kruschke stwierdza, że ​​używając JAGS z R. ... oszacowanie trybu z próbki MCMC może być raczej niestabilne, ponieważ oszacowanie opiera się na algorytmie wygładzania, który może być wrażliwy na przypadkowe nierówności i pomarszczenia w próbce MCMC. ( Doing Bayesian Data Analysis , …
12 bayesian  mcmc  mode 


4
Jak obliczyć przedziały ufności dla współczynników?
Rozważ eksperyment, który daje stosunek między 0 a 1. Sposób uzyskania tego stosunku nie powinien być istotny w tym kontekście. Został on opracowany w poprzedniej wersji tego pytania , ale został usunięty dla jasności po dyskusji na temat meta .XjaXiX_i Ten eksperyment powtarza się razy, podczas gdy jest małe (około …



3
Co to znaczy, że coś ma dobre właściwości dla częstych?
Często słyszałem to zdanie, ale nigdy całkowicie nie rozumiałem, co to znaczy. Wyrażenie „dobre właściwości dla częstych” ma obecnie około 2750 trafień w google, 536 na scholar.google.com i 4 na stats.stackexchange.com . Najbliższy rzeczą znalazłem do jasnej definicji pochodzi z końcowego slajd w prezentacji Stanford University , który stanowi, [T] …




1
Istotność statystyczna różnicy między odległościami
Mam ponad 3000 wektorów na dwuwymiarowej siatce o mniej więcej jednolitym dyskretnym rozkładzie. Niektóre pary wektorów spełniają określony warunek. Uwaga: warunek dotyczy tylko par wektorów, a nie pojedynczych wektorów. Mam listę około 1500 takich par, nazwijmy to grupą 1. Grupa 2 zawiera wszystkie inne pary wektorów. Chcę dowiedzieć się, czy …


3
Architektury neuronowe: automatyczne projektowanie oparte na danych
Ostatnie postępy w sieciach neuronowych podsumowuje szereg nowatorskich architektur charakteryzujących się głównie rosnącą złożonością projektową. Od LeNet5 (1994) do AlexNet (2012), do Overfeat (2013) i GoogleLeNet / Inception (2014) i tak dalej ... Czy jest jakaś próba umożliwienia maszynie podjęcia decyzji / zaprojektowania architektury, która ma być użyta w zależności …

1
Filtr ładowania początkowego / algorytm filtra cząstek stałych (zrozumienie)
Naprawdę nie rozumiem, jak działa filtr ładowania początkowego. Z grubsza znam pojęcia, ale nie rozumiem niektórych szczegółów. To pytanie jest dla mnie, aby usunąć bałagan. W tym miejscu użyję tego popularnego algorytmu filtrowania z referencji Douceta (do tej pory uważam, że jest to najłatwiejsza referencja). Pozwól mi najpierw powiedzieć, że …

1
MCMC; Czy możemy być pewni, że mamy „czystą” i „wystarczająco dużą” próbkę z tyłu? Jak to może działać, jeśli nie jesteśmy?
Odnosząc się do tego wątku: Jak wyjaśniłbyś Markov Chain Monte Carlo (MCMC) laikowi? . Widzę, że jest to kombinacja Łańcuchów Markowa i Monte Carlo: łańcuch Markowa jest tworzony z tylnym jako niezmienny ograniczający rozkład, a następnie rysuje Monte Carlo (zależne) z rozkładu ograniczającego (= nasz tylny). Powiedzmy (wiem, że tutaj …
12 mcmc 

6
Czy istnieje jakiś rozkład jednowymiarowy, z którego nie możemy próbkować?
Mamy ogromną różnorodność metod losowego generowania z rozkładów jednowymiarowych (transformacja odwrotna, akceptacja-odrzucenie, Metropolis-Hastings itp.) I wydaje się, że możemy próbkować z dosłownie dowolnego prawidłowego rozkładu - czy to prawda? Czy możesz podać jakiś przykład rozkładu jednowymiarowego, którego nie można losowo wygenerować? Wydaje mi się, że ten przykład, w którym jest …

Korzystając z naszej strony potwierdzasz, że przeczytałeś(-aś) i rozumiesz nasze zasady używania plików cookie i zasady ochrony prywatności.
Licensed under cc by-sa 3.0 with attribution required.