Jednym z późnych wypowiedzi RA Fishera były okresy odniesienia i zasadnicze argumenty . Podejście to nie jest jednak tak popularne, jak argumenty częste lub bayesowskie. Jaki jest argument argumentacyjny i dlaczego nie został zaakceptowany?
Czy przy obliczaniu macierzy kowariancji próbki można uzyskać macierz symetryczną i dodatnią? Obecnie mój problem obejmuje próbkę 4600 wektorów obserwacyjnych i 24 wymiary.
Wiadomości informują, że CERN ogłosi jutro, że bozon Higgsa został eksperymentalnie wykryty na podstawie dowodów 5 . Zgodnie z tym artykułem:σσ\sigma 5 oznacza 99,99994% szansy, że dane, które widzą detektory CMS i ATLAS, to nie tylko przypadkowy szum - i 0,00006% szansy, że zostali oszukani; 5 \ sigma jest niezbędna …
Napisałem program komputerowy, który potrafi wykrywać monety na obrazie statycznym (.jpeg, .png itp.) Przy użyciu standardowych technik wizji komputerowej (rozmycie gaussowskie, progowanie, transformata Hougha itp.). Używając proporcji monet zebranych z danego obrazu, mogę z całą pewnością ustalić, które monety są. Chciałbym jednak dodać do moich poziomów ufności, a także ustalić, …
Chciałbym wiedzieć, czy istnieje wariant boxplot przystosowany do danych rozproszonych Poissona (a może innych dystrybucji)? Przy rozkładzie Gaussa, wąsy umieszczone na L = Q1 - 1,5 IQR i U = Q3 + 1,5 IQR, wykres pudełkowy ma właściwość, że będzie mniej więcej tyle niskich wartości odstających (punkty poniżej L), ile …
Mam cztery różne serie czasowe pomiarów godzinnych: Zużycie ciepła w domu Temperatura na zewnątrz domu Promieniowanie słoneczne Prędkość wiatru Chcę być w stanie przewidzieć zużycie ciepła w domu. Istnieje wyraźny trend sezonowy, zarówno w ujęciu rocznym, jak i codziennym. Ponieważ istnieje wyraźna korelacja między różnymi seriami, chcę je dopasować za …
Rozumiem, że w przypadku niektórych zestawów danych, takich jak głosowanie, wyniki są lepsze. Dlaczego regresję Poissona stosuje się zamiast zwykłej regresji liniowej lub regresji logistycznej? Jaka jest motywacja matematyczna?
Biorąc pod uwagę dwa histogramy, jak oceniamy, czy są one podobne, czy nie? Czy wystarczy spojrzeć na dwa histogramy? Proste mapowanie jeden na jeden ma problem polegający na tym, że jeśli histogram jest nieco inny i nieznacznie przesunięty, nie uzyskamy pożądanego wyniku. Jakieś sugestie?
Próbuję zrozumieć standardowy błąd „klastrowanie” i sposób wykonania w języku R (w Stacie jest to trywialne). W RI nie udało mi się ani użyć ani plmnapisać własnej funkcji. Użyję diamondsdanych z ggplot2paczki. Potrafię robić stałe efekty z dowolnymi zmiennymi obojętnymi > library(plyr) > library(ggplot2) > library(lmtest) > library(sandwich) > # …
Wiem, że istnieje wiele materiałów wyjaśniających wartość p. Jednak koncepcja nie jest łatwa do zrozumienia bez dalszego wyjaśnienia. Oto definicja wartości p z Wikipedii: Wartość p jest prawdopodobieństwem uzyskania statystyki testowej co najmniej tak ekstremalnej jak ta, którą rzeczywiście zaobserwowano, przy założeniu, że hipoteza zerowa jest prawdziwa. ( http://en.wikipedia.org/wiki/P-value ) …
Szukam dobrej książki / samouczka, aby dowiedzieć się o analizie przeżycia. Interesują mnie również referencje dotyczące przeprowadzania analizy przeżycia w języku R.
Mam zamiar pomóc w nauczaniu statystyki studentów medycyny w tym semestrze. Słyszałem wiele opowieści grozy o strachu tych uczniów przed nauką statystyki. Czy ktoś może zasugerować, co zrobić z tym strachem? (Łącza do osób, które o tym dyskutują, lub sugestie z własnego doświadczenia)
Powiedzmy, że mamy losową zmienną XXX o znanej wariancji i średniej. Pytanie brzmi: jaka jest wariancja f(X)f(X)f(X) dla danej funkcji f. Jedyną ogólną metodą, o której wiem, jest metoda delta, ale daje ona jedynie przybliżenie. Teraz interesuje mnie f(x)=x−−√f(x)=xf(x)=\sqrt{x} , ale byłoby miło poznać kilka ogólnych metod. Edytuj 29.12.2010 Przeprowadziłem …
Istnieje kilka implementacji rodziny modeli GBDT, takich jak: GBM XGBoost LightGBM Catboost. Jakie są matematyczne różnice między tymi różnymi implementacjami? Catboost wydaje się przewyższać inne implementacje, nawet używając tylko domyślnych parametrów zgodnie z tym testem , ale wciąż jest bardzo powolny. Domyślam się, że catboost nie używa zmumifikowanych zmiennych, więc …
Używamy plików cookie i innych technologii śledzenia w celu poprawy komfortu przeglądania naszej witryny, aby wyświetlać spersonalizowane treści i ukierunkowane reklamy, analizować ruch w naszej witrynie, i zrozumieć, skąd pochodzą nasi goście.
Kontynuując, wyrażasz zgodę na korzystanie z plików cookie i innych technologii śledzenia oraz potwierdzasz, że masz co najmniej 16 lat lub zgodę rodzica lub opiekuna.