Literatura dogłębnego uczenia się jest pełna sprytnych sztuczek z wykorzystaniem niestałych wskaźników uczenia się przy opadaniu gradientowym. Rzeczy takie jak rozkład wykładniczy, RMSprop, Adagrad itp. Są łatwe do wdrożenia i są dostępne w każdym pakiecie dogłębnego uczenia się, ale wydają się nie istnieć poza sieciami neuronowymi. Czy jest jakiś powód …
Niektóre testy statystyczne są solidne, a niektóre nie. Co dokładnie oznacza solidność? Zaskakujące, że nie mogłem znaleźć takiego pytania na tej stronie. Co więcej, czasami solidność i moc testu są omawiane razem. I intuicyjnie nie mogłem rozróżnić tych dwóch pojęć. Co to jest potężny test? Czym różni się od solidnego …
Jesteśmy nadejściem obliczeń kwantowych , a języki kwantowe przewidują sprzętowe komputery kwantowe dostępne teraz na wysokim i niskim poziomie dla symulowanych komputerów kwantowych. Obliczenia kwantowe wprowadzają nowe elementarne funkcje, takie jak splątanie i teleportacja kubitów, pomiar kubitów i nakładanie superpozycji na kubity. Jakie problemy statystyczne prawdopodobnie skorzystają na obliczeniach kwantowych? …
Załóżmy, że znamy p (x, y), p (x, z) ip (y, z), czy to prawda, że rozkład połączeń p (x, y, z) jest możliwy do zidentyfikowania? Czyli istnieje tylko jeden możliwy p (x, y, z), który ma powyżej marginesów?
Powiedzmy, że mamy wejściowe (predyktor) i wyjściowe (odpowiedź) punkty danych A, B, C, D, E i chcemy dopasować linię przez te punkty. Jest to prosty problem do zilustrowania pytania, ale można go również rozszerzyć na większe wymiary. Opis problemu Bieżące najlepsze dopasowanie lub hipoteza jest reprezentowane przez czarną linię powyżej. …
Czy rodzina dystrybucji ma inną definicję statystyki niż w innych dyscyplinach? Ogólnie rodzina krzywych jest zbiorem krzywych, z których każda jest podana przez funkcję lub parametryzację, w której zmienia się jeden lub więcej parametrów. Takie rodziny są wykorzystywane na przykład do charakteryzowania komponentów elektronicznych . W przypadku statystyki rodzina według …
To może być częste pytanie, ale nigdy nie znalazłem satysfakcjonującej odpowiedzi. Jak określić prawdopodobieństwo, że hipoteza zerowa jest prawdziwa (lub fałszywa)? Powiedzmy, że dajesz uczniom dwie różne wersje testu i chcesz sprawdzić, czy wersje były równoważne. Wykonujesz test t, który daje wartość p wynoszącą 0,02. Co za niezła wartość p! …
Obecnie jestem nieco zdziwiony tym, w jaki sposób opadanie gradientu mini-partii może być uwięzione w punkcie siodłowym. Rozwiązanie może być zbyt trywialne, że go nie rozumiem. Masz nową próbkę każda epoka, i oblicza nową błędów oparty na nowej partii, więc funkcja kosztu jest statyczne tylko dla każdej partii, co oznacza, …
Zdefiniuj oszacowanie lasso gdzie i ^ {th} wiersz x_i \ in \ mathbb {R} ^ p macierzy projektowej X \ in \ mathbb {R} ^ {n \ times p} jest wektorem zmiennych towarzyszących dla wyjaśnienia odpowiedzi stochastycznej y_i (dla i = 1, \ kropki n ).β^λ=argminβ∈Rp12n∥y−Xβ∥22+λ∥β∥1,β^λ=argminβ∈Rp12n‖y−Xβ‖22+λ‖β‖1,\hat\beta^\lambda = \arg\min_{\beta \in \mathbb{R}^p} …
Duży nacisk kładzie się na poleganie i zgłaszanie wielkości efektów zamiast wartości p w badaniach stosowanych (np. Cytaty poniżej). Ale czy nie jest tak, że wielkość efektu, podobnie jak wartość p, jest zmienną losową i jako taka może różnić się w zależności od próbki, gdy powtórzy się ten sam eksperyment? …
W splotowych sieciach neuronowych (CNN) matryca wag na każdym kroku zostaje odwrócona w celu uzyskania macierzy jądra przed przystąpieniem do splotu. Wyjaśnia to seria filmów Hugo Larochelle tutaj : Obliczenie ukrytych map odpowiadałoby wykonaniu dyskretnego splotu z kanałem z poprzedniej warstwy, przy użyciu macierzy jądra [...], a jądro to jest …
Zastanawiam się, czy oszacowanie maksymalnego prawdopodobieństwa kiedykolwiek użyte w statystykach. Uczymy się jego koncepcji, ale zastanawiam się, kiedy jest faktycznie używana. Jeśli przyjmiemy rozkład danych, znajdziemy dwa parametry, jeden dla średniej i jeden dla wariancji, ale czy rzeczywiście używasz go w rzeczywistych sytuacjach? Czy ktoś może mi powiedzieć prosty przypadek, …
Dlaczego nazywane są „maszynami”? Czy w tym kontekście jest używane słowo „maszyna”? (Jak nazwa „programowanie liniowe” może być myląca, ale wiemy, dlaczego nazywa się to „programowaniem”).
Używamy plików cookie i innych technologii śledzenia w celu poprawy komfortu przeglądania naszej witryny, aby wyświetlać spersonalizowane treści i ukierunkowane reklamy, analizować ruch w naszej witrynie, i zrozumieć, skąd pochodzą nasi goście.
Kontynuując, wyrażasz zgodę na korzystanie z plików cookie i innych technologii śledzenia oraz potwierdzasz, że masz co najmniej 16 lat lub zgodę rodzica lub opiekuna.