Projektuję kwestionariusz do mojej rozprawy. Jestem w trakcie sprawdzania poprawności kwestionariusza. Zastosowałem test alfa Cronbacha do początkowej grupy próbek. Odpowiedzi na kwestionariusz są w skali Likerta; może ktoś zasugerować jakiekolwiek dalsze testy, które należy zastosować, aby pomóc przetestować jego ważność. Nie jestem ekspertem w dziedzinie statystyki, więc każda pomoc byłaby …
Pełne ujawnienie: To zadanie domowe. Zamieściłem link do zestawu danych ( http://www.bertelsen.ca/R/logistic-regression.sav ) Moim celem jest zmaksymalizowanie prognozy osób spłacających zaległości kredytowe w tym zbiorze danych. Każdy model, który do tej pory wymyśliłem, przewiduje> 90% domyślnych, ale <40% domyślnych, co daje ogólną skuteczność klasyfikacji ~ 80%. Zastanawiam się więc, czy …
Próbuję ocenić 20-elementowy test wielokrotnego wyboru. Chcę przeprowadzić analizę przedmiotu, taką jak w tym przykładzie . Tak więc dla każdego pytania chcę wartość P i korelację z sumą oraz rozkład wybranych opcji. Nie wiem nic o różnych pakietach oprogramowania statystycznego, ale chciałbym używać R, ponieważ czuję się swobodnie w programowaniu, …
Dopasowuję regresję liniową regulowaną przez L1 do bardzo dużego zestawu danych (z n >> p.) Zmienne są znane z góry, ale obserwacje pojawiają się w małych porcjach. Chciałbym utrzymać dopasowanie lasso po każdym kawałku. Mogę oczywiście dopasować cały model po obejrzeniu każdego nowego zestawu obserwacji. Byłoby to jednak dość nieefektywne, …
Czy ktoś może poinformować o swoich doświadczeniach z adaptacyjnym estymatorem gęstości jądra? (Istnieje wiele synonimów: adaptacyjny | zmienny | zmienna szerokość, KDE | histogram | interpolator ...) Zmienne oszacowanie gęstości jądra mówi: „zmieniamy szerokość jądra w różnych regionach przestrzeni próbki. Istnieją dwie metody ...” w rzeczywistości więcej: sąsiedzi w pewnym …
Problem: Parametryzuję rozkłady do wykorzystania jako priorytety i dane w metaanalizie bayesowskiej. Dane są przedstawione w literaturze jako statystyki podsumowujące, prawie wyłącznie zakłada się, że są normalnie rozłożone (chociaż żadna ze zmiennych nie może być <0, niektóre są stosunkami, niektóre są masą itp.). Natknąłem się na dwa przypadki, dla których …
Jestem ciekawy, czy ktoś ma określone odniesienie (tekst lub artykuł w czasopiśmie), aby poprzeć powszechną praktykę w literaturze medycznej wykonywania obliczeń wielkości próby przy użyciu metod parametrycznych (tj. Zakładając normalny rozkład i pewną wariancję pomiarów) kiedy analiza pierwotnego wyniku próby zostanie przeprowadzona przy użyciu metod nieparametrycznych. Przykład: głównym rezultatem jest …
Zaprogramowałem regresję logistyczną przy użyciu algorytmu IRLS . Chciałbym zastosować karę LASSO , aby automatycznie wybrać odpowiednie funkcje. Przy każdej iteracji rozwiązuje się następujące kwestie: (XTWX)δβ^=XT(y−p)(XTWX)δβ^=XT(y−p)\mathbf{\left(X^TWX\right) \delta\hat\beta=X^T\left(y-p\right)} Niech będzie nieujemną liczbą rzeczywistą. Nie penalizuję przechwytywania, jak sugerowano w The Elements of. Nauka statystyczna . To samo dotyczy już zerowych współczynników. …
Czy ktoś może polecić niektóre książki, które są uważane za standardowe odniesienia do statystyki klasycznej (częstej)? IE, dość obszerna, a także dostępna od jakiegoś czasu, aby literówki i błędy w formułach mogły zostać sprawdzone i poprawione
Potrzebuję pomocy w wyjaśnianiu i cytowaniu podstawowych statystyk, tekstów lub innych odniesień, dlaczego generalnie niewłaściwe jest używanie statystyki marginesu błędu (MOE) zgłoszonej podczas głosowania w celu naiwnego zadeklarowania powiązania statystycznego. Przykład: kandydat A prowadzi kandydata B w ankiecie, procent, margines błędu dla ankietowanych wyborców.4,5 % 50039 - 3139−3139 - 314,5 …
Moje pytanie dotyczy technik radzenia sobie z niekompletnymi danymi podczas szkolenia / dopasowania / klasyfikacji klasyfikatora / modelu. Na przykład w zestawie danych zawierającym kilkaset wierszy, z których każdy ma powiedzmy pięć wymiarów i etykietę klasy jako ostatni element, większość punktów danych będzie wyglądać następująco: [0,74, 0,39, 0,14, 0,33, 0,34, …
Kiedy miałbyś tendencję do używania krzywych ROC w niektórych innych testach w celu określenia zdolności prognostycznej niektórych pomiarów wyniku? Kiedy mamy do czynienia z dyskretnymi wynikami (żywy / martwy, obecny / nieobecny), co sprawia, że krzywe ROC są mniej lub bardziej potężne niż coś w rodzaju chi-kwadrat?
Czy ktoś zna odmianę dokładnego testu Fishera, który uwzględnia wagi? Na przykład wagi próbkowania . Dlatego zamiast zwykłej tabeli krzyżowej 2x2 każdy punkt danych ma wartość „masa” lub „rozmiar” ważącą punkt. Przykładowe dane: A B weight N N 1 N N 3 Y N 1 Y N 2 N Y …
Mam zestaw danych złożony z elementów z trzech grup, nazwijmy je G1, G2 i G3. Przeanalizowałem niektóre cechy tych elementów i podzieliłem je na 3 rodzaje „zachowania” T1, T2 i T3 (w tym celu wykorzystałem analizę skupień). Więc teraz mam taką tabelę zdarzeń 3 x 3 z liczbą elementów w …
Używamy plików cookie i innych technologii śledzenia w celu poprawy komfortu przeglądania naszej witryny, aby wyświetlać spersonalizowane treści i ukierunkowane reklamy, analizować ruch w naszej witrynie, i zrozumieć, skąd pochodzą nasi goście.
Kontynuując, wyrażasz zgodę na korzystanie z plików cookie i innych technologii śledzenia oraz potwierdzasz, że masz co najmniej 16 lat lub zgodę rodzica lub opiekuna.