Statystyki i duże zbiory danych

Pytania i odpowiedzi dla osób zainteresowanych statystyką, uczeniem maszynowym, analizą danych, eksploracją danych i wizualizacją danych

4
Dlaczego średnia jest bardziej stabilna w różnych próbkach niż mediana?
Sekcja 1.7.2 odkrywania statystyk za pomocą R autorstwa Andy Fieldsa i innych, wymieniając zalety średniej i mediany, stwierdza: ... średnia jest stabilna w różnych próbkach. Wyjaśnia to wiele zalet mediany, np ... Na medianę nie mają wpływu ekstremalne wyniki na obu końcach rozkładu ... Biorąc pod uwagę fakt, że na …
22 mean  median 


7
Czy mapy cieplne są „jednym z najmniej skutecznych rodzajów wizualizacji danych”?
Pytanie: Kiedy (przy jakich typach problemów z wizualizacją danych) mapy cieplne są najbardziej skuteczne? (W szczególności bardziej skuteczny niż wszystkie inne możliwe techniki wizualizacji?) Kiedy mapy cieplne są najmniej skuteczne? Czy istnieją jakieś wspólne wzorce lub reguły, które można zastosować, aby zdecydować, czy mapa cieplna może być skutecznym sposobem wizualizacji …

1
Dlaczego funkcja kosztowa sieci neuronowych nie jest wypukła?
Jest tutaj podobny wątek ( funkcja kosztu sieci neuronowej nie jest wypukła? ), Ale nie byłem w stanie zrozumieć punktów w odpowiedziach i mój powód, by zapytać ponownie, mając nadzieję, że rozwiąże to niektóre problemy: Jeśli używam sumy kwadratowej funkcji różnicy kosztów, ostatecznie optymalizuję coś w postaci gdzie jest rzeczywistą …

1
Gradientowa propagacja wsteczna poprzez pomijanie połączeń ResNet
Jestem ciekawy, w jaki sposób gradienty są propagowane wstecz przez sieć neuronową przy użyciu modułów ResNet / pomijania połączeń. Widziałem kilka pytań na temat ResNet (np. Sieć neuronowa z połączeniami pomijanymi ), ale to pytanie dotyczy konkretnie wstecznej propagacji gradientów podczas treningu. Podstawowa architektura jest tutaj: Przeczytałem ten artykuł, Badanie …

2
Czy istnieje coś takiego jak skorygowany dla modelu regresji kwantowej?
Po uwzględnieniu w artykule modelu regresji kwantowej recenzenci chcą, żebym włączyła do niego skorygowane . Obliczyłem pseudo- (z pracy JASA Koenkera i Machado z 1999 r. ) Dla trzech kwantyli będących przedmiotem zainteresowania w moim badaniu.R2)R2)R^2R2)R2)R^2 Jednak nigdy nie słyszałem o skorygowanej wartości dla regresji kwantowej i nie wiedziałbym, jak …


3
Relu vs Sigmoid vs Softmax jako neurony z ukrytą warstwą
Bawiłem się prostą siecią neuronową z tylko jedną ukrytą warstwą, autorstwa Tensorflow, a następnie próbowałem różnych aktywacji dla ukrytej warstwy: Relu Sigmoid Softmax (cóż, zwykle softmax jest używany w ostatniej warstwie ..) Relu zapewnia najlepszą dokładność pociągu i dokładność walidacji. Nie jestem pewien, jak to wyjaśnić. Wiemy, że Relu ma …


4
Jak nazywa się ten wykres pokazujący fałszywe i prawdziwe dodatnie wskaźniki i jak jest generowany?
Poniższy obraz pokazuje ciągłą krzywą współczynników fałszywie dodatnich w stosunku do rzeczywistych wartości dodatnich: Nie od razu jednak rozumiem, jak obliczane są te stawki. Jeśli metoda jest zastosowana do zestawu danych, ma ona określoną szybkość FP i określoną szybkość FN. Czy to nie znaczy, że każda metoda powinna mieć jeden …



2
Jak uzyskać funkcję prawdopodobieństwa dla rozkładu dwumianowego do oszacowania parametru?
Według Miller i Freund's Probability and Statistics for Engineers, 8ed (str. 217–218), funkcję prawdopodobieństwa, która ma zostać zmaksymalizowana dla rozkładu dwumianowego (próby Bernoulliego) podano jako L ( p ) = ∏ni = 1pxja( 1 - p )1 - xjaL(p)=∏i=1npxi(1−p)1−xiL(p) = \prod_{i=1}^np^{x_i}(1-p)^{1-x_i} Jak dojść do tego równania? Wydaje mi się dość …



Korzystając z naszej strony potwierdzasz, że przeczytałeś(-aś) i rozumiesz nasze zasady używania plików cookie i zasady ochrony prywatności.
Licensed under cc by-sa 3.0 with attribution required.