Mam dane dotyczące gęstości ryb, które próbuję porównać między kilkoma różnymi technikami zbierania, dane mają wiele zer, a histogram wygląda na vaugley odpowiedni dla rozkładu Poissona, z tym wyjątkiem, że jako gęstości nie są to dane całkowite. Jestem stosunkowo nowy w GLM i przez ostatnie kilka dni szukałem w Internecie, …
Powiedzmy, że mam jakieś dane, a następnie dopasowuję dane do modelu (regresja nieliniowa). Następnie obliczam R-kwadrat ( ).R2R2R^2 Kiedy R-kwadrat jest ujemny, co to oznacza? Czy to znaczy, że mój model jest zły? Wiem, że zakres może wynosić [-1,1]. Kiedy wynosi 0, co to oznacza?R2R2R^2R2R2R^2
Grupa osób odpowiada na jedno pytanie. Odpowiedź może brzmieć „tak” lub „nie”. Badacz chce wiedzieć, czy wiek jest związany z rodzajem odpowiedzi. Powiązanie oceniono za pomocą regresji logistycznej, w której wiek jest zmienną objaśniającą, a typ odpowiedzi (tak, nie) jest zmienną zależną. Rozwiązano to osobno, obliczając średni wiek grup, które …
Wyreżyserowane wykresy acykliczne (DAG; np. Greenland i in., 1999) są częścią formalizmu wnioskowania przyczynowego na podstawie kontrfaktycznej interpretacji obozu przyczynowego. Na tych wykresach obecność strzałki ze zmiennej AAA do zmiennej BBB potwierdza, że zmienna AAA bezpośrednio powoduje (pewną zmianę ryzyka) zmienną BBB , a brak takiej strzałki potwierdza, że zmienna …
Kilka dni temu mój psycholog-badacz powiedział mi o swojej metodzie wyboru zmiennych do modelu regresji liniowej. Chyba nie jest dobrze, ale muszę poprosić kogoś innego, żeby się upewnić. Metoda jest następująca: Spójrz na macierz korelacji między wszystkimi zmiennymi (w tym zmienną zależną Y) i wybierz te predyktory X, które najbardziej …
Robię badania stowarzyszenia GWAS SNP na temat chorób przy użyciu oprogramowania o nazwie plink ( http://pngu.mgh.harvard.edu/~purcell/plink/download.shtml ). Z wynikami asocjacji otrzymuję wartości p dla wszystkich analizowanych SNP. Teraz używam wykresu QQ tych wartości p, aby pokazać, czy bardzo niska wartość p różni się od oczekiwanego rozkładu wartości p (rozkład równomierny). …
W Rużywam ldafunkcji z biblioteki MASSdo klasyfikacji. Jak rozumiem LDA, wejście xxx otrzyma etykietę yyy , która maksymalizuje p ( y| x)p(y|x)p(y|x) , prawda? Ale kiedy pasuję do modelu, w którym x = ( L a g1 , L a g2 )x=(L.zasol1,L.zasol2))x=(Lag1,Lag2)y= D i r e c t i o …
Poniższe są podobne, ale różnią się od poprzednich postów tutaj i tutaj Biorąc pod uwagę dwa rozkłady, które dopuszczają momenty wszystkich zamówień, jeśli wszystkie momenty dwóch rozkładów są takie same, to czy są to identyczne rozkłady? Biorąc pod uwagę dwa rozkłady, które dopuszczają funkcje generujące moment, jeśli mają takie same …
Nie jestem przyzwyczajony do używania zmiennych w formacie daty w R. Zastanawiam się tylko, czy można dodać zmienną daty jako zmienną objaśniającą w modelu regresji liniowej. Jeśli to możliwe, jak możemy interpretować współczynnik? Czy to wpływ jednego dnia na zmienną wyniku? Zobacz moją istotę z przykładem tego, co próbuję zrobić.
Próbuję uzyskać intuicję dla każdej z głównych funkcji w nauce aktuarialnej (szczególnie dla modelu proporcjonalnych zagrożeń Coxa). Oto co mam do tej pory: f(x)f(x)f(x) : począwszy od godziny rozpoczęcia, rozkład prawdopodobieństwa, kiedy umrzesz. F(x)F(x)F(x) : tylko rozkład skumulowany. W chwili jaki procent populacji będzie martwy?TTT S(x)S(x)S(x) : . W chwili …
Mam nadzieję, że możesz dać mi jakieś sugestie. Uczę w bardzo zróżnicowanym (złożonym z grup mniejszościowych) kolegium, a studenci to w większości kierunki psychologiczne. Większość uczniów pochodzi ze szkoły średniej, ale niektórzy z nich to powracający uczniowie w wieku powyżej 40 lat. Większość uczniów ma problemy motywacyjne i niechęć do …
Krótka wersja: Mam szereg danych klimatycznych, które testuję pod kątem stacjonarności. Na podstawie wcześniejszych badań spodziewam się, że model leżący u podstaw (lub, że tak powiem, „generowania” danych) będzie miał wyraz przechwytujący i pozytywny liniowy trend czasu. Aby przetestować te dane pod kątem stacjonarności, czy powinienem użyć testu Dickeya-Fullera, który …
Czy dane normalizujące (mające zerową średnią i odchylenie standardowe jedności) przed powtórzeniem k-krotnej walidacji krzyżowej mają jakieś negatywne konsekwencje, takie jak nadmierne dopasowanie? Uwaga: dotyczy to sytuacji, gdy # skrzynki> łączna liczba funkcji Przekształcam niektóre moje dane za pomocą transformacji dziennika, a następnie normalizuję wszystkie dane jak wyżej. Następnie dokonuję …
Oto mój eksperyment: Korzystam z findPeaksfunkcji w pakiecie quantmod : Chcę wykryć „lokalne” piki w granicach tolerancji 5, tj. Pierwsze lokalizacje po spadku szeregów czasowych od lokalnych pików o 5: aa=100:1 bb=sin(aa/3) cc=aa*bb plot(cc, type="l") p=findPeaks(cc, 5) points(p, cc[p]) p Dane wyjściowe to [1] 3 22 41 Wydaje się nie …
Obecnie przygotowuję prezentację plakatu i chciałbym uzyskać porady (lub odniesienia do porad) na temat niektórych aspektów grafiki. Przykłady plakatów, o których mówię, można znaleźć w materiale uzupełniającym do artykułów ASA Data Expo w tomie 20 wydanie 2 Journal of Computational and Graphical Statistics (inny przykład znajduje się tutaj ( Hendrix …
Używamy plików cookie i innych technologii śledzenia w celu poprawy komfortu przeglądania naszej witryny, aby wyświetlać spersonalizowane treści i ukierunkowane reklamy, analizować ruch w naszej witrynie, i zrozumieć, skąd pochodzą nasi goście.
Kontynuując, wyrażasz zgodę na korzystanie z plików cookie i innych technologii śledzenia oraz potwierdzasz, że masz co najmniej 16 lat lub zgodę rodzica lub opiekuna.