Próbuję dopasować dane do GLM (regresja Poissona) w R. Kiedy wykreśliłem reszty w stosunku do dopasowanych wartości, wykres utworzył wiele (prawie liniowych z lekką wklęsłą krzywą) „linii”. Co to znaczy? library(faraway) modl <- glm(doctorco ~ sex + age + agesq + income + levyplus + freepoor + freerepa + illness …
tło Jest wiele dyskusji na ten temat, więc pomyślałem, że mogę znaleźć odpowiedź z wcześniejszych kroków na StackExchange i wściekle googlować. Po pół dnia próbowania znalezienia tylko jednego podręcznika dla (bio) statystyk z R., byłem całkowicie zdezorientowany i musiałem się poddać. Może łączony darmowy materiał jest w rzeczywistości lepszy niż …
W odpowiedzi na moje pytanie dotyczące OLS zastanawiam się: jakie wykresy diagnostyczne istnieją dla regresji kwantowej? (i czy jest ich implementacja R?) Szybka wyszukiwarka google już wymyśliła fabułę robaka (o której nigdy wcześniej nie słyszałem) i chętnie poznam więcej metod, o których możesz wiedzieć. (czy któryś z nich pochodzi z …
Obliczam bardzo prosty filtr Kalmana (model chodzenia losowego + szum). Uważam, że wydajność filtra jest bardzo podobna do średniej ruchomej. Czy istnieje równoważność między nimi? Jeśli nie, jaka jest różnica?
Piszę pracę doktorską i zdałem sobie sprawę, że nadmiernie polegam na wykresach pudełkowych w celu porównania rozkładów. Jakie inne alternatywy podoba Ci się w realizacji tego zadania? Chciałbym również zapytać, czy znasz inne zasoby, takie jak galeria R, w której mogę zainspirować się różnymi pomysłami na wizualizację danych.
podczas integracji funkcji lub w złożonych symulacjach widziałem, że metoda Monte Carlo jest szeroko stosowana. Zadaję sobie pytanie, dlaczego nie generuje się siatki punktów w celu zintegrowania funkcji zamiast rysowania losowych punktów. Czy nie przyniosłoby to dokładniejszych wyników?
Rozumiem logikę kodowania do analizy danych. Moje pytanie poniżej dotyczy użycia określonego kodu. Czy istnieje powód, dla którego płeć jest często kodowana jako 0 dla kobiety i 1 dla mężczyzny? Dlaczego to kodowanie jest uważane za „standardowe”? Porównaj to z Kobietą = 1 i Mężczyzną = 2. Czy występuje problem …
W niedawnym artykule na temat wad polegania na wartości p do wnioskowania statystycznego, zatytułowanym „Matrixx przeciwko Siracusano i Student przeciwko Fisher, znaczenie statystyczne w próbie” (DOI: 10.1111 / j.1740-9713.2011.00511.x), Stephen T. Ziliak sprzeciwia się zastosowaniu wartości p. W końcowych akapitach mówi: Dane to jedna rzecz, którą już wiemy i na …
Na moim kursie statystyki elementarnej nauczyłem się konstruować 95% przedział ufności, taki jak średnia populacji, , w oparciu o asymptotyczną normalność dla „dużych” próbek. Oprócz metod ponownego próbkowania (takich jak bootstrap), istnieje inne podejście oparte na „prawdopodobieństwie profilu” . Czy ktoś mógłby wyjaśnić to podejście?μμ\mu W jakich sytuacjach skonstruowany 95% …
Zastanawiałem się, jak Bayesianie ze społeczności CrossValidated postrzegają problem niepewności modelu i jak wolą sobie z tym poradzić? Postaram się zadać pytanie w dwóch częściach: Jak ważne (według twojego doświadczenia / opinii) jest radzenie sobie z niepewnością modelu? Nie znalazłem żadnych artykułów na ten temat w społeczności uczącej się maszynowo, …
Natknąłem się na kilka przewodników sugerujących, że używam nlm R do oszacowania maksymalnego prawdopodobieństwa. Ale żadna z nich (w tym dokumentacja R ) nie zawiera wielu teoretycznych wskazówek dotyczących tego, kiedy używać lub nie korzystać z tej funkcji. O ile mi wiadomo, nlm po prostu wykonuje opadanie gradientu wzdłuż linii …
To jest mój pierwszy post, więc uspokój się, jeśli nie przestrzegam niektórych standardów! Poszukałem pytania i nic nie wyszło. Moje pytanie dotyczy głównie praktycznych różnic między ogólnym modelowaniem liniowym (GLM) a uogólnionym modelowaniem liniowym (GZLM). W moim przypadku byłoby to kilka zmiennych ciągłych jako współzmiennych i kilka czynników w ANCOVA …
Wiem, że w sytuacji regresji, jeśli masz zestaw wysoce skorelowanych zmiennych, jest to zwykle „złe” ze względu na niestabilność szacowanych współczynników (wariancja zmierza w kierunku nieskończoności, gdy wyznacznik zmierza w kierunku zera). Moje pytanie brzmi, czy ta „zła” utrzymuje się w sytuacji PCA. Czy współczynniki / obciążenia / ciężary / …
Poza oczywistymi cechami klasyfikatora, takimi jak koszt obliczeniowy, oczekiwane typy danych funkcji / etykiet i przydatność do określonych rozmiarów i wymiarów zbiorów danych, jakich pięciu najlepszych (lub 10, 20?) klasyfikatorów wypróbowuje najpierw na nowym zbiorze danych , o którym jeszcze niewiele wiadomo (np. semantyka i korelacja poszczególnych cech)? Zwykle wypróbowuję …
Używamy plików cookie i innych technologii śledzenia w celu poprawy komfortu przeglądania naszej witryny, aby wyświetlać spersonalizowane treści i ukierunkowane reklamy, analizować ruch w naszej witrynie, i zrozumieć, skąd pochodzą nasi goście.
Kontynuując, wyrażasz zgodę na korzystanie z plików cookie i innych technologii śledzenia oraz potwierdzasz, że masz co najmniej 16 lat lub zgodę rodzica lub opiekuna.