Biorąc pod uwagę dwie tablice x i y o długości n, dopasowuję model y = a + b * x i chcę obliczyć 95% przedział ufności dla nachylenia. Jest to (b - delta, b + delta), gdzie b znajduje się w zwykły sposób i delta = qt(0.975,df=n-2)*se.slope a se.slope to …
Obecnie oceniam wielokoliniowość w moich zestawach danych. Jakie wartości progowe VIF i wskaźnika stanu poniżej / powyżej sugerują problem? VIF: Słyszałem, że VIF jest problemem.≥ 10≥10\geq 10 Po usunięciu dwóch zmiennych problemowych VIF wynosi dla każdej zmiennej. Czy zmienne wymagają dalszego leczenia, czy też ten VIF wydaje się w porządku?≤ …
Zamknięte. To pytanie jest nie na temat . Obecnie nie przyjmuje odpowiedzi. Chcesz poprawić to pytanie? Zaktualizuj pytanie, aby było tematem dotyczącym weryfikacji krzyżowej. Zamknięte 5 miesięcy temu . Podczas kreślenia wykresu pudełkowego za pomocą python matplotblib linie w połowie wykresu są medianą rozkładu. Czy istnieje możliwość, aby zamiast tego …
Podczas programowania w R kilkakrotnie korzystałem z pakietu wielordzeniowego . Jednak nigdy nie widziałem oświadczenia o tym, jak radzi sobie z liczbami losowymi. Kiedy używam openMP z C, ostrożnie używam odpowiedniego równoległego RNG, ale z R zakładam, że dzieje się coś sensownego. Czy ktoś może potwierdzić, że dzieje się coś …
Algorytmy MCMC, takie jak próbkowanie Metropolis-Hastings i Gibbs, są sposobami próbkowania ze wspólnych rozkładów tylnych. Wydaje mi się, że rozumiem i potrafię dość łatwo wdrożyć pospieszanie metropolii - po prostu wybierasz punkty początkowe i „chodzisz po przestrzeni parametrów” losowo, kierując się gęstością a posteriori i gęstością propozycji. Próbkowanie Gibbsa wydaje …
Załóżmy, że istnieje szereg czasowy, z którego można wykonać różne pomiary, takie jak okres, maksimum, minimum, średnia itp., A następnie użyć ich do stworzenia modelowej fali sinusoidalnej o tych samych atrybutach, czy można zastosować metody statystyczne, które można by obliczyć jak bardzo rzeczywiste dane pasują do założonego modelu? Liczba punktów …
Mam eksperyment, który spróbuję tu streścić. Wyobraź sobie, że rzucam przed sobą trzy białe kamienie i proszę, abyś osądził ich pozycję. Rejestruję różnorodne właściwości kamieni i twoją odpowiedź. Robię to na wiele tematów. Generuję dwa modele. Jednym z nich jest to, że najbliższy kamień przewiduje Twoją odpowiedź, a drugi to, …
Wiem, że większość z was prawdopodobnie uważa, że Dokumenty Google są nadal prymitywnym narzędziem. To nie jest Matlab ani R, a nawet Excel. Jestem jednak zaskoczony mocą tego oprogramowania internetowego, które korzysta tylko z możliwości działania przeglądarki (i jest kompatybilne z wieloma przeglądarkami, które działają zupełnie inaczej). Aktywny na tym …
Pracuję nad projektem, który obejmuje 14 zmiennych i 345 000 obserwacji danych mieszkaniowych (takich jak rok budowy, powierzchnia, sprzedana cena, okręg zamieszkania itp.). Niepokoję się próbą znalezienia dobrych technik graficznych i bibliotek R, które zawierają niezłe techniki kreślenia. Już widzę, co w ggplot i sieci będą ładnie działały, i myślę …
Chociaż zostałem przeszkolony jako inżynier, odkryłem, że coraz bardziej interesuję się eksploracją danych. W tej chwili próbuję dokładniej zbadać tę dziedzinę. W szczególności chciałbym zrozumieć różne kategorie narzędzi programowych, które istnieją i które narzędzia są godne uwagi w każdej kategorii i dlaczego. (Zauważ, że nie powiedziałem „najlepszych” narzędzi, tylko te …
Kolega (niestatystyczny) napotyka metaanalizę w artykułach, które recenzuje w czasopismach medycznych i szuka dobrego leczenia wprowadzającego, aby mógł się kształcić. Jakieś rekomendacje? Ulubione? Książki, monografie, nietechniczne artykuły z ankiet byłyby w porządku. (Tak, zna wpis z Wikipedii i inne rzeczy łatwo dostępne za pomocą wyszukiwarki Google, takie jak miły, mały …
Jako inżynier oprogramowania interesuję się takimi tematami, jak algorytmy statystyczne, eksploracja danych, uczenie maszynowe, sieci bayesowskie, algorytmy klasyfikacji, sieci neuronowe, łańcuchy Markowa, metody Monte Carlo i generowanie liczb losowych. Osobiście nie miałem przyjemności pracy z żadną z tych technik, ale musiałem pracować z oprogramowaniem, które pod maską je zastosowało i …
Co sądzisz o zastosowaniu technik uczenia maszynowego, takich jak losowe lasy lub regresja karna (z karą L1 lub L2 lub ich kombinacją) w małych próbach klinicznych, gdy celem jest wyodrębnienie interesujących predyktorów w kontekście klasyfikacji? To nie jest pytanie o wybór modelu, ani nie pytam, jak znaleźć optymalne oszacowania zmiennego …
Używamy plików cookie i innych technologii śledzenia w celu poprawy komfortu przeglądania naszej witryny, aby wyświetlać spersonalizowane treści i ukierunkowane reklamy, analizować ruch w naszej witrynie, i zrozumieć, skąd pochodzą nasi goście.
Kontynuując, wyrażasz zgodę na korzystanie z plików cookie i innych technologii śledzenia oraz potwierdzasz, że masz co najmniej 16 lat lub zgodę rodzica lub opiekuna.