Statystyki i duże zbiory danych

Pytania i odpowiedzi dla osób zainteresowanych statystyką, uczeniem maszynowym, analizą danych, eksploracją danych i wizualizacją danych

3
Jaki jest odpowiedni model dla danych o niskiej rozproszeniu?
Próbuję modelować dane zliczania w R, które najwyraźniej są rozproszone (parametr dyspersji ~ .40). Prawdopodobnie dlatego model glmz family = poissonlub ujemny glm.nbmodel dwumianowy ( ) nie są znaczące. Kiedy patrzę na opisy moich danych, nie mam typowego skosu danych zliczania, a reszty w moich dwóch warunkach eksperymentalnych są również …

4
Jak określić kwantyle (izoliny?) O wielowymiarowym rozkładzie normalnym
Interesuje mnie, jak można obliczyć kwantyl rozkładu wielowymiarowego. Na rysunkach narysowałem 5% i 95% kwantyli danego rozkładu jednowymiarowego normalnego (po lewej). Dla właściwego wielowymiarowego rozkładu normalnego wyobrażam sobie, że analog byłby izoliną otaczającą podstawę funkcji gęstości. Poniżej znajduje się przykład mojej próby obliczenia tego za pomocą pakietu mvtnorm- ale bez …

5
Moduł Pythona do analizy punktu zmiany
Szukam modułu Python, który wykonuje analizę zmiany punktu na szeregu czasowym. Istnieje wiele różnych algorytmów i chciałbym zbadać skuteczność niektórych z nich bez konieczności ręcznego rzucania każdym z algorytmów. Idealnie chciałbym, aby niektóre moduły, takie jak bcp (Bayesian Change Point) lub pakiety strucchange w R. Spodziewałem się znaleźć kilka w …


6
Wprowadzenie do modelowania równań strukturalnych
Koledzy proszą mnie o pomoc w tym temacie, której tak naprawdę nie wiem. W jednym badaniu postawili hipotezy dotyczące roli niektórych ukrytych zmiennych, a sędzia poprosił ich o sformalizowanie tego w SEM. Ponieważ to, czego potrzebują, nie wydaje się zbyt trudne, myślę, że dam temu szansę ... na razie szukam …


2
Czy potrafisz wyjaśnić oszacowanie gęstości okna Parzen (jądra) w kategoriach laika?
Oszacowanie gęstości okna Parzen jest opisane jako p(x)=1n∑i=1n1h2ϕ(xi−xh)p(x)=1n∑i=1n1h2ϕ(xi−xh) p(x)=\frac{1}{n}\sum_{i=1}^{n} \frac{1}{h^2} \phi \left(\frac{x_i - x}{h} \right) gdzie jest liczbą elementów w wektorze, jest wektorem, jest gęstością prawdopodobieństwa , jest wymiarem okna Parzen, a jest funkcją okna.nnnxxxp(x)p(x)p(x)xxxhhhϕϕ\phi Moje pytania to: Jaka jest podstawowa różnica między funkcją okna Parzen a innymi funkcjami gęstości, …

3
Jakie są „współczynniki aliasowane”?
Podczas budowania modelu regresji w R ( lm) często otrzymuję ten komunikat "there are aliased coefficients in the model" Co to dokładnie znaczy? Również z tego powodu predict()daje ostrzeżenie. Chociaż jest to tylko ostrzeżenie, chcę wiedzieć, w jaki sposób możemy wykryć / usunąć aliowane współczynniki przed zbudowaniem modelu. Jakie są …
24 r  regression 


1
F1 / Dice-Score vs IoU
Byłem zdezorientowany różnicami między wynikiem F1, wynikiem Dice i IoU (przecięcie przez związek). Do tej pory dowiedziałem się, że F1 i Dice oznaczają to samo (prawda?), A IoU ma bardzo podobną formułę do pozostałych dwóch. F1 / Dice:2 tP.2 tP.+ F.P.+ F.N.2)T.P.2)T.P.+faP.+faN.\frac{2TP}{2TP+FP+FN} IoU / Jaccard:T.P.T.P.+ F.P.+ F.N.T.P.T.P.+faP.+faN.\frac{TP}{TP+FP+FN} Czy są jakieś …

2
Dlaczego lambda „w granicach jednego błędu standardowego od minimum” jest zalecaną wartością dla lambda w regresji elastycznej sieci?
Rozumiem, jaką rolę odgrywa lambda w regresji sieci elastycznej. Rozumiem, dlaczego należy wybrać lambda.min, wartość lambda, która minimalizuje błąd zwalidowany krzyżowo. Moje pytanie brzmi: gdzie w literaturze statystycznej zaleca się stosowanie lambda.1se, czyli takiej wartości lambda, która minimalizuje błąd CV plus jeden błąd standardowy ? Nie mogę znaleźć formalnego cytatu, …


2
Jak zainicjować elementy macierzy filtrów?
Próbuję lepiej zrozumieć splotowe sieci neuronowe, pisząc kod Pythona, który nie zależy od bibliotek (takich jak Convnet lub TensorFlow), i utknąłem w literaturze na temat wyboru wartości dla macierzy jądra, kiedy przeprowadzanie splotu obrazu. Próbuję zrozumieć szczegóły implementacji na etapie między mapami funkcji na poniższym obrazku pokazującym warstwy CNN. Zgodnie …

3
Jakie jest prawdopodobieństwo, że spośród 25 liczb losowych od 1 do 100 najwyższa pojawi się więcej niż jeden raz?
W wielu grach online, gdy gracze wykonują trudne zadanie, czasami przyznawana jest specjalna nagroda, z której mogą skorzystać wszyscy, którzy ukończyli zadanie. jest to zazwyczaj wierzchowiec (metoda transportu) lub inny przedmiot próżności (przedmioty, które nie poprawiają wydajności postaci i służą głównie do dostosowywania wyglądu). Gdy taka nagroda jest przyznawana, najczęstszym …


Korzystając z naszej strony potwierdzasz, że przeczytałeś(-aś) i rozumiesz nasze zasady używania plików cookie i zasady ochrony prywatności.
Licensed under cc by-sa 3.0 with attribution required.