Próbuję modelować zmienną odpowiedzi, która teoretycznie jest ograniczona między -225 a +225. Zmienna to łączny wynik uzyskany przez badanych podczas gry. Chociaż teoretycznie możliwe jest zdobycie przez uczestników +225 punktów. Pomimo tego, ponieważ wynik zależał nie tylko od działań podmiotów, ale także działań innych działań, maksymalna liczba zdobytych punktów wyniosła …
W odniesieniu do ważenia wyniku skłonności (IPTW) podczas modelowania proporcjonalnego hazardu Coxa danych dotyczących przeżycia czasu do zdarzenia: Mam potencjalne dane rejestru, w których jesteśmy zainteresowani spojrzeniem na efekt leczenia lekiem, który w większości przypadków pacjenci przyjmowali już na początku. Dlatego nie jestem pewien, jak najlepiej analizować dane. Potencjalnie pewne …
Chciałbym porównać 2 różne klasyfikatory dla problemu klasyfikacji tekstów wieloklasowych, które wykorzystują duże zestawy danych szkoleniowych. Wątpię, czy powinienem użyć krzywych ROC, czy krzywych uczenia się, aby porównać 2 klasyfikatory. Z jednej strony krzywe uczenia się są przydatne do decydowania o wielkości zbioru danych szkoleniowych, ponieważ można znaleźć rozmiar zbioru …
Mam kwadrat 2D i mam w nim zestaw punktów, powiedzmy 1000 punktów. Potrzebuję sposobu, aby sprawdzić, czy rozkład punktów wewnątrz kwadratu jest rozłożony (lub bardziej lub mniej równomiernie rozmieszczony), czy też mają tendencję do gromadzenia się w jakimś miejscu wewnątrz kwadratu. Potrzebuję matematycznego / statystycznego (nie programistycznego) sposobu, aby to …
Mam duże dane ankietowe, binarną zmienną wyniku i wiele zmiennych objaśniających, w tym binarną i ciągłą. Buduję zestawy modeli (eksperymentuję zarówno z GLM, jak i mieszanym GLM) i wykorzystuję podejścia teoretyczne do wyboru najlepszego modelu. Dokładnie przeanalizowałem wyjaśnienia (zarówno ciągłe, jak i kategoryczne) pod kątem korelacji i używam tylko tych …
Muszę narysować liczby losowe z rozkładu log-cauchy'ego, który ma gęstość: Czy ktoś może mi pomóc lub wskazać mi książkę / artykuł, który mógłby mi pokazać, w jaki sposób?fa( x ; μ , σ) = 1x πσ[ 1 + ( l n ( x ) - μσ)2)].fa(x;μ,σ)=1xπσ[1+(ln(x)-μσ)2)].f(x;\mu,\sigma)=\frac{1}{x\pi\sigma\left[1+\left(\frac{ln(x)-\mu}{\sigma}\right)^2\right]}.
Staram się inteligentnie bin posortować kolekcję. Mam kolekcję fragmentów danych. Ale wiem, że te dane wpisuje się nierówno wielkości pojemników. Nie wiem, jak inteligentnie wybrać punkty końcowe, aby odpowiednio dopasować dane. na przykład:nnnmmm Powiedzmy, że mam w mojej kolekcji 12 produktów i wiem, że dane zmieszczą się w 3 pojemnikach: …
W moich danych obserwuję dziwne wzorce w resztkach: [EDYCJA] Oto wykresy częściowej regresji dla dwóch zmiennych: [EDIT2] Dodano wykres PP Wygląda na to, że dystrybucja jest w porządku (patrz poniżej), ale nie mam pojęcia, skąd ta prosta może pochodzić. Jakieś pomysły? [AKTUALIZACJA 31.07] Okazuje się, że miałeś całkowitą rację, miałem …
Mam grupę terapeutyczną o wielkości 30 (30 szkół w Kalifornii), która korzystała z dodatkowego oprogramowania matematycznego. W prostej analizie chciałbym porównać średni wzrost matematyki uczniów między naszą grupą leczoną a porównywalną grupą kontrolną. W CA jest wiele szkół, które nie korzystały z oprogramowania. Chciałbym, aby grupa kontrolna obejmowała szkoły o …
Najprostsza forma teoretycznego CLT informacji jest następująca: Niech będą równe średniej i wariancji . Niech będzie gęstością znormalizowanej sumy a będzie standardową gęstością Gaussa. Następnie teoretyczna informacja CLT stwierdza, że jeśli jest skończone dla jakiegoś n , to D (f_n \ | \ phi) \ do 0 jako n \ …
Staram się przewidzieć sukces lub porażkę uczniów na podstawie niektórych funkcji za pomocą modelu regresji logistycznej. Aby poprawić wydajność modelu, już myślałem o podzieleniu uczniów na różne grupy w oparciu o oczywiste różnice i zbudowaniu osobnych modeli dla każdej grupy. Sądzę jednak, że identyfikacja tych grup na podstawie badań może …
Niezwykle częstą sytuacją w grafice komputerowej jest to, że kolor niektórych pikseli jest równy całce funkcji o wartościach rzeczywistych. Często funkcja jest zbyt skomplikowana, aby ją rozwiązać analitycznie, więc pozostaje nam przybliżenie numeryczne. Ale funkcja ta jest również często bardzo droga do obliczenia, dlatego jesteśmy bardzo ograniczeni liczbą próbek, które …
Biorąc pod uwagę (obserwowana) Czas serii o x t ∈ { 1 , . . . , N } , to jest test statystyczny testowania zerową hipotezę, że P ( X , T | X T - 1 , X t - 2 , . . . , X 1 …
Prowadzę badania w dziedzinie odpowiedzi funkcjonalnej roztoczy. Chciałbym zrobić regresję, aby oszacować parametry (szybkość ataku i czas obsługi) funkcji Rogers typu II. Mam zestaw danych z pomiarami. Jak mogę najlepiej określić wartości odstające? Do mojej regresji używam następującego skryptu w R (regresja nieliniowa): (zestaw danych to prosty 2-kolumnowy plik tekstowy …
Używamy plików cookie i innych technologii śledzenia w celu poprawy komfortu przeglądania naszej witryny, aby wyświetlać spersonalizowane treści i ukierunkowane reklamy, analizować ruch w naszej witrynie, i zrozumieć, skąd pochodzą nasi goście.
Kontynuując, wyrażasz zgodę na korzystanie z plików cookie i innych technologii śledzenia oraz potwierdzasz, że masz co najmniej 16 lat lub zgodę rodzica lub opiekuna.