Zawody Kaggle określają końcowe rankingi na podstawie ustalonego zestawu testów. Wyciągnięty zestaw testowy jest próbką; może nie być reprezentatywny dla modelowanej populacji. Ponieważ każde zgłoszenie jest jak hipoteza, algorytm, który wygrał konkurencję, może po prostu przypadkiem dopasować zestaw testowy lepiej niż inne. Innymi słowy, gdyby wybrano inny zestaw testów i …
Czytałem o paradoksie zakładów Blackwella na szafie Futility . Oto podsumowanie: otrzymasz dwie koperty, i . Koperty zawierają losową kwotę pieniędzy, ale nie wiesz nic o dystrybucji pieniędzy. Otworzysz jeden, sprawdzisz ile pieniędzy tam jest ( ) i będziesz musiał wybrać: weź kopertę czy ?E yExExE_xEyEyE_yxxxExExE_xEyEyE_y Futility Closet odnosi się …
Oto zabawny problem przyniesiony mi przez studenta. Chociaż pierwotnie było sformułowane w kategoriach wzajemnie anihilujących pocisków wystrzeliwanych w regularnych odstępach przez broń, pomyślałem, że może ci się podobać bardziej spokojna prezentacja. W nieskończonym płaskim świecie Oz Żółta Ceglana Droga zaczyna się w centrum Szmaragdowego Miasta, odpręża się na wsi i …
Jeśli jest rozkładem prawdopodobieństwa z niezerowymi wartościami na , dla jakiego typu (typów) istnieje stała taka, że dla wszystkich ?p(x)p(x)p(x)[0,+∞)[0,+∞)[0,+\infty)p(x)p(x)p(x)c>0c>0c\gt 0∫∞0p(x)logp(x)(1+ϵ)p(x(1+ϵ))dx≤cϵ2∫0∞p(x)logp(x)(1+ϵ)p(x(1+ϵ))dx≤cϵ2\int_0^{\infty}p(x)\log{\frac{ p(x)}{(1+\epsilon)p({x}(1+\epsilon))}}dx \leq c \epsilon^20<ϵ<10<ϵ<10\lt\epsilon\lt 1 Powyższa nierówność jest w rzeczywistości rozbieżnością Kullbacka-Leiblera między rozkładem a jego skompresowaną wersją . Dowiedziałem się, że ta nierówność dotyczy rozkładów wykładniczych, gamma i …
Jestem zdezorientowany niektórymi szczegółami na temat twierdzenia Słuckiego : Niech , będą dwiema sekwencjami losowych elementów skalarnych / wektorowych / macierzowych.{ Y n }{ Xn}{Xn}\{X_n\}{ Yn}{Yn}\{Y_n\} Jeśli zbiega się w rozkładzie do losowego elementu a zbiega się w prawdopodobieństwie do stałej , to pod warunkiem, że c jest odwracalne, gdzie …
Tło: Istnieje kilka świetnych pytań / odpowiedzi na temat kalibracji modeli, które przewidują prawdopodobieństwo wystąpienia wyniku. Na przykład Wynik Briera i jego rozkład na rozdzielczość, niepewność i wiarygodność . Wykresy kalibracyjne i regresja izotoniczna . Metody te często wymagają zastosowania metody binowania na przewidywanych prawdopodobieństwach, dzięki czemu zachowanie wyniku (0, …
Jak podano w tytule, powiedzmy, jeśli losuję 4 karty, a ty dobierasz 6 z tej samej talii, jakie jest prawdopodobieństwo, że moja najwyższa karta pobije Twoją najwyższą kartę? Jak to się zmieni, jeśli będziemy czerpać z różnych talii? Dzięki!
Mam bardzo duży zestaw danych i brakuje około 5% wartości losowych. Te zmienne są ze sobą skorelowane. Poniższy przykładowy zestaw danych R jest tylko zabawkowym przykładem z fałszywymi skorelowanymi danymi. set.seed(123) # matrix of X variable xmat <- matrix(sample(-1:1, 2000000, replace = TRUE), ncol = 10000) colnames(xmat) <- paste ("M", …
Korzystam z Bayesa, aby rozwiązać problem klastrowania. Po kilku obliczeniach kończę z koniecznością uzyskania stosunku dwóch prawdopodobieństw: P(A)/P(B)P(A)/P(B)P(A)/P(B) być w stanie uzyskać . Te prawdopodobieństwa są uzyskiwane przez integrację dwóch różnych wielowymiarowych KDE 2D, jak wyjaśniono w tej odpowiedzi :P(H|D)P(H|D)P(H|D) P(A)=∬x,y:f^(x,y)<f^(ra,sa)f^(x,y)dxdyP(A)=∬x,y:f^(x,y)<f^(ra,sa)f^(x,y)dxdyP(A) = \iint_{x, y : \hat{f}(x, y) < \hat{f}(r_a, s_a)} …
Studiuję o rozkładzie t-Studenta i zacząłem się zastanawiać, jak można wyprowadzić funkcję gęstości rozkładów t (z wikipedii, http://en.wikipedia.org/wiki/Student%27s_t-distribution ): fa( t ) = Γ ( v + 12))v π--√Γ ( w2))( 1 + t2)v)- v + 12)f(t)=Γ(v+12)vπΓ(v2)(1+t2v)−v+12f(t) = \frac{\Gamma(\frac{v+1}{2})}{\sqrt{v\pi}\:\Gamma(\frac{v}{2})}\left(1+\frac{t^2}{v} \right)^{-\frac{v+1}{2}} gdzie to stopnie swobody, a to funkcja gamma. Jaka jest …
Czy ktoś może zasugerować, gdzie uzyskać wyniki 10 000 rzutów monetą (tj. Wszystkich 10 000 głów i reszek) wykonanych przez Johna Kerricha podczas II wojny światowej?
W duchu tego pytania. Rozumiejąc dowód lematu stosowanego w nierówności Hoeffdinga , staram się zrozumieć kroki, które prowadzą do nierówności Hoeffdinga. Najbardziej tajemnicą dla mnie jest część obliczania momentów wykładniczych dla sumy zmiennych iid, po których stosuje się nierówność Markowa. Moim celem jest zrozumienie: Dlaczego ta technika powoduje ścisłą nierówność …
Pochodzę z tego pytania, na wypadek, gdyby ktoś chciał pójść szlakiem. Zasadniczo mam zestaw danych złożony z obiektów, w których do każdego obiektu przypisana jest dana liczba zmierzonych wartości (w tym przypadku dwóch):NΩΩ\OmegaN.N.N Ω = o1[ x1, y1] , o2)[ x2), y2)] , . . . , oN.[ xN., yN.]Ω=o1[x1,y1],o2)[x2),y2)],...,oN.[xN.,yN.]\Omega …
Tenis ma osobny trzypoziomowy system punktacji i zastanawiam się, czy ma to jakąkolwiek statystyczną korzyść z punktu widzenia meczu jako eksperymentu mającego na celu ustalenie lepszego gracza. Dla tych, którzy nie są zaznajomieni, w normalnych zasadach gra jest wygrywana od pierwszych do 4 punktów, o ile masz 2-punktową przewagę (tzn. …
Używamy plików cookie i innych technologii śledzenia w celu poprawy komfortu przeglądania naszej witryny, aby wyświetlać spersonalizowane treści i ukierunkowane reklamy, analizować ruch w naszej witrynie, i zrozumieć, skąd pochodzą nasi goście.
Kontynuując, wyrażasz zgodę na korzystanie z plików cookie i innych technologii śledzenia oraz potwierdzasz, że masz co najmniej 16 lat lub zgodę rodzica lub opiekuna.