Statystyki i duże zbiory danych

Pytania i odpowiedzi dla osób zainteresowanych statystyką, uczeniem maszynowym, analizą danych, eksploracją danych i wizualizacją danych

2
Czy powszechną praktyką jest minimalizowanie średniej straty w partiach zamiast sumy?
Tensorflow ma przykładowy samouczek na temat klasyfikowania CIFAR-10 . W samouczku średnia utrata entropii krzyżowej w partii jest zminimalizowana. def loss(logits, labels): """Add L2Loss to all the trainable variables. Add summary for for "Loss" and "Loss/avg". Args: logits: Logits from inference(). labels: Labels from distorted_inputs or inputs(). 1-D tensor of …

4
Interpretacja ujemnego podobieństwa cosinus
Moje pytanie może być głupie. Więc z góry przepraszam. Próbowałem użyć modelu GLOVE wstępnie przeszkolonego przez grupę NLP Stanforda ( link ). Zauważyłem jednak, że moje wyniki podobieństwa wykazały pewne liczby ujemne. To natychmiast skłoniło mnie do spojrzenia na plik danych słowo-wektor. Najwyraźniej wartości w wektorach słów mogły być ujemne. …

4
Czy można podawać obrazy o zmiennej wielkości jako dane wejściowe do splotowej sieci neuronowej?
Czy możemy podać obrazy o zmiennej wielkości jako dane wejściowe do splotowej sieci neuronowej w celu wykrywania obiektów? Jeśli to możliwe, jak możemy to zrobić? Ale jeśli spróbujemy przyciąć obraz, stracimy część obrazu i jeśli spróbujemy zmienić jego rozmiar, wówczas jasność obrazu zostanie utracona. Czy to oznacza, że ​​korzystanie z …


4
Dlaczego niezależność oznacza zerową korelację?
Przede wszystkim nie pytam o to: Dlaczego zerowa korelacja nie oznacza niezależności? Jest to rozwiązane (raczej ładnie) tutaj: /math/444408/why-does-zero-correlation-not-imply-independence Pytam o coś przeciwnego ... powiedzmy, że dwie zmienne są całkowicie niezależne od siebie. Czy nie mogliby przez przypadek mieć odrobinę korelacji? Czy nie powinno być ... niezależność oznacza BARDZO MAŁĄ …


3
Jak definiuje się związek przyczynowy?
Jaka jest matematyczna definicja związku przyczynowego między dwiema zmiennymi losowymi? Biorąc pod uwagę próbkę ze wspólnego rozkładu dwóch zmiennych losowych XXX i YYY , kiedy powiedzielibyśmy, że XXX powoduje YYY ? Dla kontekstu czytam ten artykuł o odkryciu przyczynowym .


3
Czy istnieje więcej niż jedna formuła „mediana”?
W mojej pracy, gdy osoby odnoszą się do „średniej” wartości zbioru danych, zwykle odnoszą się do średniej arytmetycznej (tj. „Średniej” lub „wartości oczekiwanej”). Gdybym podał średnią geometryczną , ludzie prawdopodobnie pomyśleliby, że jestem złośliwy lub nieprzydatny, ponieważ definicja „środka” jest znana z góry. Próbuję ustalić, czy istnieje wiele definicji „mediany” …

1
Co to znaczy, że AUC jest częściowo poprawną zasadą punktacji?
Właściwa reguła punktacji jest regułą, która jest maksymalizowana przez „prawdziwy” model i nie pozwala na „zabezpieczanie” lub granie w system (celowe zgłaszanie różnych wyników, jak to jest prawdziwe przekonanie modelu o poprawie wyniku). Wynik Briera jest prawidłowy, dokładność (proporcja sklasyfikowana poprawnie) jest niewłaściwa i często zniechęcana. Czasami widzę, że AUC …

2
Jakie formy dystrybucji dają „oczekiwanie Pitagorasa”?
Niech i będą niezależnymi ciągłymi zmiennymi losowymi wygenerowanymi z tej samej nieokreślonej postaci dystrybucyjnej, ale z uwzględnieniem różnych wartości parametrów. Interesuje mnie znalezienie formularza rozkładu parametrycznego, dla którego obowiązuje następujące prawdopodobieństwo próbkowania dla wszystkich dopuszczalnych wartości parametrów:X∼Dist(θX)X∼Dist(θX)X \sim \text{Dist}(\theta_X)Y∼Dist(θY)Y∼Dist(θY)Y \sim \text{Dist}(\theta_Y) P(X>Y|θX,θY)=θ2Xθ2X+θ2Y.P(X>Y|θX,θY)=θX2θX2+θY2.\mathbb{P}(X > Y| \theta_X, \theta_Y) = \frac{\theta_X^2}{\theta_X^2 + \theta_Y^2}. …

4
Jak statystyki bayesowskie radzą sobie z brakiem priorytetów?
To pytanie zostało zainspirowane dwiema niedawnymi interakcjami, które miałem, jedną tutaj w CV , drugą w ekonomics.se. Tam miałem wysłana odpowiedź do znanego „Koperta Paradox” (Pamiętaj, a nie jak w „poprawnej odpowiedzi”, ale jako odpowiedź płynącą z określonych założeń o strukturze sytuacji). Po pewnym czasie użytkownik opublikował krytyczny komentarz, a …


6
Jak mogłem odkryć rozkład normalny?
Jakie było pierwsze wyprowadzenie rozkładu normalnego, czy możesz odtworzyć to wyprowadzenie, a także wyjaśnić je w kontekście historycznym ? Chodzi mi o to, że gdyby ludzkość zapomniała o normalnym rozkładzie, jaki jest najbardziej prawdopodobny sposób, aby go odkryć na nowo i jakie byłoby najbardziej prawdopodobne pochodzenie? Sądzę, że pierwsze pochodne …

2
Co się tutaj dzieje, kiedy używam kwadratowej straty w ustawieniach regresji logistycznej?
Próbuję użyć straty kwadratowej, aby dokonać klasyfikacji binarnej na zestawie danych zabawki. Korzystam z mtcarszestawu danych, wykorzystuję milę na galon i wagę, aby przewidzieć rodzaj transmisji. Poniższy wykres pokazuje dwa typy danych typu transmisji w różnych kolorach oraz granicę decyzji wygenerowaną przez inną funkcję strat. Kwadratowa strata wynosi ∑i(yi−pi)2∑ja(yja-pja)2)\sum_i (y_i-p_i)^2 …

Korzystając z naszej strony potwierdzasz, że przeczytałeś(-aś) i rozumiesz nasze zasady używania plików cookie i zasady ochrony prywatności.
Licensed under cc by-sa 3.0 with attribution required.