W artykule, który napisałem, modeluję zmienne losowe i X - Y zamiast X i Y, aby skutecznie usunąć problemy, które powstają, gdy X i Y są wysoce skorelowane i mają jednakową wariancję (jak w mojej aplikacji) . Sędziowie chcą, żebym podał referencję. Mógłbym to łatwo udowodnić, ale jako dziennik aplikacji …
Kontekst Chcę ustawić scenę, zanim nieco rozwinę pytanie. Mam dane podłużne, pomiary wykonywane na osobach co około 3 miesiące, pierwotny wynik jest liczbowy (jak ciągły do 1dp) w zakresie od 5 do 14, a większość (wszystkich punktów danych) wynosi od 7 do 10. Jeśli zrobię wykres spaghetti (z wiekiem na …
Moje dane są następujące. Mam dwie grupy pacjentów. Pacjenci w każdej grupie mieli inny rodzaj operacji oka. 5 zmiennych zmierzono u pacjentów w każdej grupie. Chcę porównać te zmienne między dwiema grupami za pomocą testu permutacji lub MANOVA. Oko, na którym przeprowadzono operację, nie ma tak naprawdę znaczenia w analizie. …
Zamknięte. To pytanie jest nie na temat . Obecnie nie przyjmuje odpowiedzi. Chcesz poprawić to pytanie? Zaktualizuj pytanie, aby było tematem dotyczącym weryfikacji krzyżowej. Zamknięte w zeszłym roku . Używam pojedynczego rozkładu wektora na macierzy i otrzymuję macierze U, S i Vt. W tym momencie próbuję wybrać próg liczby wymiarów …
Załóżmy, że masz zestaw danych z ciągłego rozkładu o gęstości obsługiwanej na który nie jest znany, ale jest dość duży, więc gęstość jądra (na przykład) szacunek jest dość dokładny. Dla konkretnego zastosowania muszę przekształcić obserwowane dane w skończoną liczbę kategorii, aby uzyskać nowy zestaw danych z implikowaną funkcją masy .Y1,...,YnY1,...,YnY_{1}, …
Muszę dopasować uogólniony rozkład Gaussa do 7-słabej chmury punktów zawierającej dość znaczną liczbę wartości odstających o dużej dźwigni. Czy znasz jakiś dobry pakiet R dla tej pracy?
To było w mojej głowie przez co najmniej kilka godzin. Próbowałem znaleźć optymalne k dla danych wyjściowych z algorytmu k-średnich (z metryką podobieństwa kosinusowego ), więc skończyłem na wykreślaniu zniekształcenia w funkcji liczby klastrów. Mój zestaw danych to zbiór 800 dokumentów w 600-wymiarowej przestrzeni. Z tego, co rozumiem, znalezienie punktu …
To jest mój pierwszy raz tutaj, więc proszę dać mi znać, czy mogę wyjaśnić moje pytanie w jakikolwiek sposób (w tym formatowanie, tagi itp.). (Mam nadzieję, że mogę później edytować!) Próbowałem znaleźć referencje i próbowałem rozwiązać siebie za pomocą indukcji, ale nie udało mi się obu. Próbuję uprościć dystrybucję, która …
Zastanawiam się tylko, czy ktoś jest zaznajomiony z grupowaniem nominalnych danych wejściowych. Patrzyłem na SOM jako rozwiązanie, ale najwyraźniej działa tylko z funkcjami numerycznymi. Czy są jakieś rozszerzenia dla funkcji jakościowych? W szczególności zastanawiałem się nad „Dniami tygodnia” jako możliwymi funkcjami. Oczywiście możliwe jest przekonwertowanie go na funkcję numeryczną (tj. …
Czy istnieje sposób, aby po zbudowaniu złożonego drzewa klasyfikacji za pomocą rpart (w R) zorganizować reguły decyzyjne dla każdej klasy? Więc zamiast uzyskać jedno wielkie drzewo, otrzymujemy zestaw reguł dla każdej z klas? (Jeśli tak to jak?) Oto prosty przykład kodu, który pokazuje przykłady: fit <- rpart(Kyphosis ~ Age + …
Być może słyszałeś o niedawnym wybuchu enterohaemorrragag E. coli ( EHEC ) w Niemczech . Jakie pytania zadałby statystyk w sprawie analizy EHEC? Mam na myśli Q + Jak między reporterami a urzędnikami publicznymi ↔ nie-ekspertami, powiedzmy nauczycielom i inżynierom z dyplomem / magisterskim, ale co najwyżej odrobinę statystyk. (Czy …
Zazwyczaj mam do czynienia z danymi, w których każda z wielu osób jest mierzona wiele razy w każdym z 2 lub więcej warunków. Ostatnio bawiłem się modelowaniem efektów mieszanych w celu oceny dowodów na różnice między warunkami, modelowanie individualjako efekt losowy. Aby zwizualizować niepewność dotyczącą prognoz z takiego modelowania, korzystałem …
Jako zarówno statystyki, jak i początkujący R, miałem naprawdę trudny czas, próbując wygenerować qqploty o współczynniku proporcji 1: 1. ggplot2 wydaje się oferować znacznie większą kontrolę nad wykreślaniem niż domyślne pakiety wydruku R, ale nie widzę, jak zrobić qqplot w ggplot2, aby porównać dwa zestawy danych. Więc moje pytanie, jaki …
Pracuję z niektórymi dużymi zestawami danych przy użyciu pakietu gbm w R. Zarówno moja macierz predykcyjna, jak i mój wektor odpowiedzi są dość rzadkie (tzn. Większość wpisów ma wartość zero). Miałem nadzieję zbudować drzewa decyzyjne przy użyciu algorytmu, który korzysta z tej rzadkości, jak to tutaj zrobiono ). W tym …
Prowadzę wstępny kurs z geografii ekonomicznej. Aby pomóc moim studentom w lepszym zrozumieniu rodzajów krajów obecnych we współczesnej gospodarce światowej i docenieniu technik ograniczania danych, chcę skonstruować zadanie, które stworzy typologię różnych rodzajów krajów (np. wartość dodana MFG długa żywotność; eksporter zasobów naturalnych o wysokich dochodach średni i średni oczekiwany …
Używamy plików cookie i innych technologii śledzenia w celu poprawy komfortu przeglądania naszej witryny, aby wyświetlać spersonalizowane treści i ukierunkowane reklamy, analizować ruch w naszej witrynie, i zrozumieć, skąd pochodzą nasi goście.
Kontynuując, wyrażasz zgodę na korzystanie z plików cookie i innych technologii śledzenia oraz potwierdzasz, że masz co najmniej 16 lat lub zgodę rodzica lub opiekuna.