Użyj tego znacznika w przypadku każdego * pytania na temat *, które (a) obejmuje `R` jako krytyczną część pytania lub oczekiwaną odpowiedź, a (b) nie jest * tylko * o tym, jak używać` R`.
Chciałbym wykonać test post-hoc TukeyHSD po mojej dwukierunkowej Anova z R, uzyskując tabelę zawierającą posortowane pary pogrupowane według znaczących różnic. (Przepraszam za brzmienie, wciąż jestem nowy ze statystykami). Chciałbym mieć coś takiego: Pogrupowane w gwiazdki lub litery. Dowolny pomysł? Testowałem funkcję HSD.test()z agricolaepakietu, ale wygląda na to, że nie obsługuje …
Próbuję modelować niektóre dane przy użyciu glmnetpakietu w R. Załóżmy, że mam następujące dane training_x <- data.frame(variable1 = c(1, 2, 3, 2, 3), variable2 = c(1, 2, 3, 4, 5)) y <- c(1, 2, 3, 4, 5) (Jest to uproszczenie; moje dane są znacznie bardziej skomplikowane.) Następnie użyłem następującego kodu, …
Próbuję przewidzieć przy użyciu losowego modelu lasu w R. Jednak dostaję błędy, ponieważ niektóre czynniki mają inne wartości w zestawie testowym niż w zestawie treningowym. Na przykład czynnik Cat_2ma wartości 34, 68, 76itp. W zestawie testowym, które nie pojawiają się w zestawie szkoleniowym. Niestety nie mam kontroli nad zestawem testowym …
W odpowiedzi na pytanie o wybór modelu w obecności Współliniowość , Frank Harrell zaproponował : Umieść wszystkie zmienne w modelu, ale nie testuj wpływu jednej zmiennej skorygowanej o skutki zmiennych konkurujących ... Testy fragmentów zmiennych konkurencyjnych są potężne, ponieważ zmienne współliniowe łączą siły w ogólnym teście asocjacji wielokrotnego stopnia swobody …
To pytanie dotyczy również Pythona jako stołu roboczego statystyk i przoduje jako stół roboczy statystyk . Wiem, że istnieje ogromna dyskusja na temat Ruby kontra Python, ale nie o to chodzi w tym pytaniu. Pomyślałem, że Ruby jest szybszy od Pythona i ma bardzo naturalną składnię, co może pomóc mi …
Gram z randomForest i odkryłem, że ogólnie zwiększenie sampSize prowadzi do lepszej wydajności. Czy istnieje reguła / formuła / itp., Która sugeruje, jaki powinien być optymalny sampSize, czy też jest to kwestia prób i błędów? Chyba inny sposób sformułowania tego; jakie jest moje ryzyko zbyt małego rozmiaru sampSize lub zbyt …
Mam zestaw danych zawierający wiele proporcji, które sumują się do 1. Jestem zainteresowany zmianą tych proporcji wzdłuż gradientu (patrz na przykład dane poniżej). gradient <- 1:99 A1 <- gradient * 0.005 A2 <- gradient * 0.004 A3 <- 1 - (A1 + A2) df <- data.frame(gradient = gradient, A1 = …
Mamy potencjalny biomarker do przewidywania, czy pacjent ma raka, czy nie. Wynik testu biomarkera jest dodatni lub ujemny. Chcemy dowiedzieć się, jaką liczbę pacjentów należy zbadać, aby ustalić, czy ten biomarker jest dobrym predyktorem, czy nie. Z lektury w Internecie wydaje się, że najlepiej jest przyjrzeć się czułości (liczby przypadków) …
To pytanie wynika z mojego faktycznego zamieszania dotyczącego tego, jak zdecydować, czy model logistyczny jest wystarczająco dobry. Mam modele, które wykorzystują stan par projekt indywidualny dwa lata po ich uformowaniu jako zmienna zależna. Wynik jest udany (1) lub nie (0). Mam zmienne niezależne mierzone w czasie tworzenia par. Moim celem …
Jaki jest najłatwiejszy sposób przekonwertowania tabeli częstotliwości za pomocą R lub Excela na wektor wartości? Np. Jak przekonwertować poniższą tabelę częstotliwości Value Frequency 1. 2 2. 1 3. 4 4. 2 5. 1 w następujący wektor? 1, 1, 2, 3, 3, 3, 3, 4, 4, 5
Korzystając z następującego kodu, próbowałem narysować cztery wykresy na wykresie w R. Nie jestem zadowolony z tej figury, ponieważ między wykresami jest dużo miejsca, dlatego szerokość wykresów nie jest wystarczająca do analizy wykresów. Czy ktoś mógłby mi pomóc w stworzeniu ładnego wykresu zawierającego cztery wykresy? Jak mogę zachować etykiety osi …
Zamknięte. To pytanie jest nie na temat . Obecnie nie przyjmuje odpowiedzi. Chcesz poprawić to pytanie? Zaktualizuj pytanie, aby było tematem dotyczącym weryfikacji krzyżowej. Zamknięte w zeszłym roku . Podążam kursem statystyki bayesowskiej używając BŁĘDÓW i R. Teraz już znam BŁĘDY, to świetnie, ale tak naprawdę nie lubię używać osobnego …
Zablokowana . To pytanie i odpowiedzi są zablokowane, ponieważ pytanie jest nie na temat, ale ma znaczenie historyczne. Obecnie nie akceptuje nowych odpowiedzi ani interakcji. Jestem bardzo nowy w R i jakichkolwiek pakietach w R. Spojrzałem na dokumentację ggplot2, ale nie mogłem tego znaleźć. Chcę wykresu zmiennej zmiennej boxthisw odniesieniu …
to jest mój pierwszy post. Jestem naprawdę wdzięczny za tę społeczność. Usiłuję analizować dane zliczania wzdłużnego, które są obcinane przez zero (prawdopodobieństwo, że zmienna odpowiedzi = 0 wynosi 0), a średnia! = Wariancja, więc wybrano ujemny rozkład dwumianowy nad poissonem. Funkcje / polecenia, które wykluczyłem: R Funkcja gee () w …
Eksperymentuję z klasyfikowaniem danych do grup. Jestem całkiem nowy w tym temacie i staram się zrozumieć wyniki niektórych analiz. Korzystając z przykładów z Quick-R , Rsugerowanych jest kilka pakietów. Próbowałem użyć dwóch z tych pakietów ( fpcużywając kmeansfunkcji i mclust). Jednym aspektem tej analizy, którego nie rozumiem, jest porównanie wyników. …
Używamy plików cookie i innych technologii śledzenia w celu poprawy komfortu przeglądania naszej witryny, aby wyświetlać spersonalizowane treści i ukierunkowane reklamy, analizować ruch w naszej witrynie, i zrozumieć, skąd pochodzą nasi goście.
Kontynuując, wyrażasz zgodę na korzystanie z plików cookie i innych technologii śledzenia oraz potwierdzasz, że masz co najmniej 16 lat lub zgodę rodzica lub opiekuna.