Mam dopasowany model (z literatury). Mam również surowe dane dla zmiennych predykcyjnych. Jakie równanie powinienem zastosować, aby uzyskać prawdopodobieństwa? Zasadniczo, jak połączyć surowe dane i współczynniki, aby uzyskać prawdopodobieństwa?
Chcę zbudować model predykcyjny do przewidywania odejścia i chcę zastosować dyskretny model przetrwania dopasowany do zestawu danych szkoleniowych na okres personalny (jeden wiersz dla każdego klienta i dyskretny okres, w którym byli narażeni, ze wskaźnikiem zdarzenia - równym 1 jeśli rezygnacja nastąpiła w tym okresie, w przeciwnym razie 0). Dopasowuję …
Wzrost liczby zachorowań i zgonów występuje podczas epidemii (nagły wzrost liczby) z powodu krążenia wirusów (jak wirus Zachodniego Nilu w USA w 2002 r.) Lub zmniejszającej się odporności ludzi lub zanieczyszczenia żywności lub wody lub wzrostu liczby komary. Epidemie te będą występować jako wartości odstające, które mogą wystąpić co 1–5 …
I przeprowadzeniu analizy głównych składowych sześć zmiennych , , , , E i F . Jeśli dobrze rozumiem, niezabezpieczone PC1 mówi mi, jaka liniowa kombinacja tych zmiennych opisuje / wyjaśnia największą wariancję danych, a PC2 mówi mi, jaka liniowa kombinacja tych zmiennych opisuje następną największą wariancję danych i tak dalej. …
Próbuję zrozumieć logikę testu F ANOVA w prostej analizie regresji liniowej. Pytanie, które mam, jest następujące. Gdy wartość F, tj. MSR/MSEJest duża, akceptujemy model jako znaczący. Jaka jest logika tego?
Zamknięte. To pytanie jest nie na temat . Obecnie nie przyjmuje odpowiedzi. Chcesz poprawić to pytanie? Zaktualizuj pytanie, aby było tematem dotyczącym weryfikacji krzyżowej. Zamknięte 2 lata temu . Używam Sweave i xtable do generowania raportu. Chciałbym dodać trochę koloru na stole. Ale nie udało mi się znaleźć żadnego sposobu …
Uczę klasę statystyk wprowadzających i przeglądałem rodzaje próbkowania, w tym próbkowanie systematyczne, w którym próbkuje się każdą k-tą osobę lub obiekt. Student zapytał, czy pobieranie próbek od każdej osoby o określonej charakterystyce osiągnęłoby to samo. Na przykład, czy pobieranie próbek od każdej osoby w niebieskiej koszulce byłoby wystarczająco losowe i …
Przygotowując się do wykładu, który wkrótce przedstawię, niedawno zacząłem zagłębiać się w dwa główne (bezpłatne) narzędzia do interaktywnej wizualizacji danych: GGobi i Mondrian - oba oferują szeroki zakres możliwości (nawet jeśli są nieco wadliwe). Chciałbym prosić o twoją pomoc w artykułowaniu (zarówno dla siebie, jak i dla mojej przyszłej publiczności) …
Mam nadzieję, że mogę zadać to pytanie w prawidłowy sposób. Mam dostęp do play-by-play danych, więc jest to większy problem z najlepszym podejściem i konstruowania dane poprawnie. Co szukam zrobić to obliczyć prawdopodobieństwo wygranej jest NHL gra dany wynik i czas pozostały do rozporządzenia. I postać mogę używać regresji logistycznej, …
Czy ktoś napisał krótką ankietę na temat różnych podejść do statystyki? Do pierwszego przybliżenia masz statystyki częste i bayesowskie. Ale jeśli spojrzeć bliżej masz też inne podejścia jak likelihoodist i empirycznych Bayesa. A potem masz podziały w grupach, takie jak subiektywny Bayes obiektywny Bayes w statystykach Bayesa itp. Wyrób badanie …
Niedawno przeczytałem radę, że powinieneś raczej używać mediany, a nie oznaczać eliminacji wartości odstających. Przykład: następujący artykuł http://www.amazon.com/Forensic-Science-Introduction-Scientific-Investigative/product-reviews/1420064932/ ma w tej chwili 16 opinii: review= c(5, 5, 5, 5, 5, 5, 5, 5, 5, 5, 4, 4, 3, 2, 1, 1) summary(review) ## "ordinary" summary Min. 1st Qu. Median Mean …
Mam algorytm grupowania (nie k-średnich) z parametrem wejściowym (liczba klastrów). Po wykonaniu grupowanie Chciałbym zaczerpnąć ilościową miarą jakości tego grupowania. Algorytm klastrów ma jedną istotną właściwość. Dla , jeśli karmię punktów danych bez istotnej różnicy między nimi do tego algorytmu w wyniku otrzymam jeden klaster zawierający punktów danych i jeden …
Aby skalibrować poziom ufności do prawdopodobieństwa w nadzorowanym uczeniu się (powiedzmy, aby odwzorować pewność z SVM lub drzewa decyzyjnego przy użyciu danych z nadpróbkowanych danych) jedną z metod jest zastosowanie skalowania Platta (np. Uzyskiwanie skalibrowanych prawdopodobieństw z wzmocnienia ). Zasadniczo używa się regresji logistycznej do mapowania na . Zmienna zależna …
Szukam dobrego samouczka na temat grupowania danych przy Rużyciu hierarchicznego procesu dirichleta (HDP) (jednej z najnowszych i popularnych nieparametrycznych metod bayesowskich). Istnieje DPpackage(IMHO, najbardziej wszechstronny ze wszystkich dostępnych) w Rnieparametrycznej analizie bayesowskiej. Ale nie jestem w stanie zrozumieć przykładów podanych w R Newsinstrukcji obsługi pakietu lub wystarczająco dobrze, aby zakodować …
W poprzednim pytaniu poprosiłem o narzędzia do edycji plików CSV . Gavin powiązał z komentarzem R Help autorstwa Duncana Murdocha sugerującym, że Data Interchange Format to bardziej niezawodny sposób przechowywania danych niż CSV. W przypadku niektórych aplikacji potrzebny jest dedykowany system zarządzania bazą danych. Jednakże, w przypadku projektów małych analizy …
Używamy plików cookie i innych technologii śledzenia w celu poprawy komfortu przeglądania naszej witryny, aby wyświetlać spersonalizowane treści i ukierunkowane reklamy, analizować ruch w naszej witrynie, i zrozumieć, skąd pochodzą nasi goście.
Kontynuując, wyrażasz zgodę na korzystanie z plików cookie i innych technologii śledzenia oraz potwierdzasz, że masz co najmniej 16 lat lub zgodę rodzica lub opiekuna.