Statystyki i duże zbiory danych

Pytania i odpowiedzi dla osób zainteresowanych statystyką, uczeniem maszynowym, analizą danych, eksploracją danych i wizualizacją danych

3
Hidden Markov Model vs Recurrent Neural Network
Które problemy z sekwencyjnym wejściem są najbardziej odpowiednie dla każdego? Czy wymiar wejściowy określa, które z nich jest lepsze? Czy problemy wymagające „dłuższej pamięci” lepiej pasują do RNN LSTM, podczas gdy problemy z cyklicznymi wzorcami wprowadzania danych (giełda, pogoda) są łatwiejsze do rozwiązania przez HMM? Wygląda na to, że nakładają …


3
Jaka jest metoda momentów i czym różni się od MLE?
Zasadniczo wydaje się, że metoda momentów polega jedynie na dopasowaniu obserwowanej średniej próbki lub wariancji do momentów teoretycznych w celu uzyskania oszacowań parametrów. Rozumiem, że jest to często to samo co MLE dla rodzin wykładniczych. Jednak trudno jest znaleźć jasną definicję metody momentów i jasną dyskusję na temat tego, dlaczego …




1
Interpretowanie proporcji, które sumują się jako jedna zmienna niezależna w regresji liniowej
Znam pojęcie zmiennych kategorialnych i odpowiednie kodowanie zmiennych zastępczych, które pozwalają nam dopasować jeden poziom jako poziom podstawowy, aby uniknąć kolinearności. Znam również sposób interpretacji oszacowań parametrów z takich modeli: Przewidywana zmiana wyniku dla danego dopasowanego poziomu predyktora jakościowego w stosunku do kategorii podstawowej. Nie jestem pewien, jak interpretować zestaw …



2
Współczynnik korelacji między (niesychotomiczną) zmienną nominalną a zmienną liczbową (przedział) lub porządkową
Przeczytałem już wszystkie strony w tej witrynie, próbując znaleźć odpowiedź na mój problem, ale wydaje się, że nikt nie jest właściwy dla mnie ... Najpierw wyjaśnię ci dane, z którymi pracuję ... Powiedzmy, że mam wektor tablicowy z kilkoma nazwami miast, po jednym dla każdego z 300 użytkowników. Mam też …

1
Ustawić seed przed każdym blokiem kodu lub raz na projekt?
Standardową wskazówką jest ustawienie losowego materiału siewnego, aby można było odtworzyć wyniki. Ponieważ jednak ziarno jest posuwane naprzód w miarę losowania liczb pseudolosowych, wyniki mogą ulec zmianie, jeśli jakikolwiek fragment kodu losuje dodatkową liczbę. Na pierwszy rzut oka kontrola wersji wydaje się rozwiązaniem tego problemu, ponieważ przynajmniej pozwoli ci cofnąć …

2
Korzyści z procesów gaussowskich
Mam to zamieszanie związane z korzyściami procesów Gaussa. Mam na myśli porównanie z prostą regresją liniową, w której zdefiniowaliśmy, że funkcja liniowa modeluje dane. Jednak w procesach gaussowskich definiujemy rozkład funkcji, co oznacza, że ​​nie definiujemy konkretnie, że funkcja powinna być liniowa. Możemy zdefiniować przejęcie przed funkcją, które jest przejęciem …

2
Obliczanie prawdopodobieństwa nakładania się listy genów między sekwencją RNA a zestawem danych ChIP-chip
Mam nadzieję, że ktoś na tych forach pomoże mi rozwiązać ten podstawowy problem w badaniach nad ekspresją genów. Przeprowadziłem głębokie sekwencjonowanie tkanki eksperymentalnej i kontrolnej. Następnie uzyskałem krotną wartość wzbogacenia genów w próbce eksperymentalnej nad kontrolą. Referencyjny genom ma około 15 000 genów. 3000 z 15 000 genów jest wzbogaconych …

1
Dlaczego norma partii ma możliwą do nauczenia skalę i przesunięcie?
O ile rozumiem, norma wsadowa normalizuje wszystkie cechy wejściowe do warstwy do jednostkowego rozkładu normalnego, . Średnia i wariancja są szacowane poprzez pomiar ich wartości dla bieżącej mini-partii.N(μ=0,σ=1)N(μ=0,σ=1)\mathcal{N}(\mu=0,\sigma=1)μ,σ2μ,σ2\mu, \sigma^2 Po normalizacji dane wejściowe są skalowane i przesuwane o wartości skalarne: x^′i=γx^i+βx^i′=γx^i+β\hat{x}_i' = \gamma \hat{x}_i + \beta (Popraw mnie, jeśli się …

5
Czy istnieje wizualne narzędzie do projektowania i stosowania sieci neuronowych / głębokiego uczenia się? [Zamknięte]
Zamknięte. To pytanie jest nie na temat . Obecnie nie przyjmuje odpowiedzi. Chcesz poprawić to pytanie? Zaktualizuj pytanie, aby było tematem dotyczącym weryfikacji krzyżowej. Zamknięte 10 miesięcy temu . Wiem, że istnieje wiele bibliotek do uczenia maszynowego i dogłębnego uczenia się, takich jak caffe, Theano, TensorFlow, keras, ... Ale wydaje …

Korzystając z naszej strony potwierdzasz, że przeczytałeś(-aś) i rozumiesz nasze zasady używania plików cookie i zasady ochrony prywatności.
Licensed under cc by-sa 3.0 with attribution required.