uwaga: bez poprawnych odpowiedzi po miesiącu, przeszedłem do SO tło Mam model, , gdzie Y = f ( X )fafafY= f( X )Y=fa(X)Y=f(\textbf{X}) jestmacierzą n × m próbek z m parametrów, a Y jestwektorem n × 1 wyników modelu.XX\textbf{X}n × mn×mn \times mmmmYYYn × 1n×1n \times 1 jest intensywne obliczeniowo, …
Próbowałem obliczyć 95 percentyl na podstawie następującego zestawu danych. Natknąłem się na kilka internetowych odniesień do robienia tego. Podejście 1: na podstawie danych przykładowych Pierwszy mówi mi, w celu otrzymania TOP 95 Percentzbioru danych, a następnie wybierz MINlub AVGotrzymanego zestawu. Robienie tego dla następującego zestawu danych daje mi: AVG: 29162 …
Badam różne metody klasyfikacji dla projektu, nad którym pracuję i jestem zainteresowany wypróbowaniem Losowych Lasów. Staram się kształcić na bieżąco i byłbym wdzięczny za wszelką pomoc ze strony społeczności CV. Podzieliłem swoje dane na zestawy szkoleniowe / testowe. Po eksperymentach z losowymi lasami w R (przy użyciu pakietu randomForest) miałem …
Wiem, że korelacja nie oznacza związku przyczynowego, ale siłę i kierunek związku. Czy prosta regresja liniowa oznacza związek przyczynowy? Czy jest do tego wymagany test wnioskowania (test t itp.)?
Jestem studentem medycyny próbującym zrozumieć statystyki (!) - więc proszę, bądź delikatny! ;) Piszę esej zawierający sporo analizy statystycznej, w tym analizy przeżycia (regresja Kaplana-Meiera, Log-Ranka i regresji Coxa). Przeprowadziłem regresję Coxa na moich danych, próbując dowiedzieć się, czy mogę znaleźć znaczącą różnicę między zgonami pacjentów w dwóch grupach (pacjenci …
Mam pewne dane o skumulowanej częstotliwości. Linia wygląda tak, jakby bardzo dobrze pasowała do danych, ale w linii występuje cykliczne / okresowe poruszenie. Chciałbym oszacować, kiedy skumulowana częstotliwość osiągnie pewną wartość c . Kiedy wykreślam wartości resztkowe względem dopasowanych, otrzymuję piękne zachowanie sinusoidalne.y=ax+by=ax+by=ax+bccc Teraz, aby dodać kolejną komplikację, zwróć uwagę, …
Odkrywam cudowny świat tzw. „Ukrytych modeli Markowa”, zwanych również „modelami zmiany reżimu”. Chciałbym dostosować HMM w R do wykrywania trendów i punktów zwrotnych. Chciałbym zbudować model tak ogólny, jak to możliwe, aby móc przetestować go na wielu cenach. Czy ktoś może polecić papier? Widziałem (i czytałem) (więcej niż) kilka, ale …
Jednym ze sposobów podsumowania porównania dwóch krzywych przeżycia jest obliczenie współczynnika ryzyka (HR). Istnieją (co najmniej) dwie metody obliczenia tej wartości. Metoda logrank. W ramach obliczeń Kaplana-Meiera oblicz liczbę zaobserwowanych zdarzeń (zwykle zgonów) w każdej grupie ( i O b ) oraz liczbę oczekiwanych zdarzeń przy założeniu zerowej hipotezy o …
Próbuję wypracować sposób przeprowadzenia testu hipotez regresji liniowej (hipoteza zerowa nie koreluje). Wydaje się, że każdy przewodnik i strona na temat, na które natrafiam, używa testu t-testowego. Ale nie rozumiem, co tak naprawdę oznacza test t dla regresji liniowej. Test t, o ile nie mam całkowicie błędnego zrozumienia lub modelu …
Szukam nieinformacyjnych priorytetów dla dystrybucji beta do pracy z procesem dwumianowym (Hit / Miss). Na początku myślałem o użyciu α=1,β=1α=1,β=1\alpha=1, \beta=1 które generują jednolity plik PDF, lub Jeffrey przed α=0.5,β=0.5α=0.5,β=0.5\alpha=0.5, \beta=0.5 . Ale tak naprawdę szukam priorów, które mają minimalny wpływ na późniejsze wyniki, a potem pomyślałem o użyciu niewłaściwego …
W praktyce powszechne jest stosowanie standardowego testu T do sprawdzenia znaczenia współczynnika regresji liniowej. Mechanika obliczeń ma dla mnie sens. Dlaczego rozkład T można wykorzystać do modelowania standardowej statystyki testowej stosowanej w testowaniu hipotez regresji liniowej? Standardowa statystyka testu, o której mowa tutaj: T0=βˆ−β0SE(βˆ)T0=β^−β0SE(β^) T_{0} = \frac{\widehat{\beta} - \beta_{0}}{SE(\widehat{\beta})}
Mam zestaw 150 funkcji, a wiele z nich jest ze sobą bardzo skorelowanych. Moim celem jest przewidzenie wartości zmiennej dyskretnej, której zakres wynosi 1-8 . Mój rozmiar próbki wynosi 550 i używam 10-krotnej walidacji krzyżowej. AFAIK, wśród metod regularyzacji (Lasso, ElasticNet i Ridge), Ridge jest bardziej rygorystyczny w zakresie korelacji …
Czy istnieją jakieś „nieparametryczne” metody klastrowania, dla których nie musimy określać liczby klastrów? I inne parametry, takie jak liczba punktów na klaster itp.
Jak przejść do obliczania tylnej z wcześniejszym N ~ (a, b) po zaobserwowaniu n punktów danych? Zakładam, że musimy obliczyć średnią próbki i wariancję punktów danych i wykonać jakieś obliczenia, które łączą tylną z wcześniejszą, ale nie jestem pewien, jak wygląda wzór kombinacji.
Jeśli dane mają wartość 1d, wariancja pokazuje stopień, w jakim punkty danych różnią się od siebie. Jeśli dane są wielowymiarowe, otrzymamy macierz kowariancji. Czy istnieje miara, która podaje pojedynczą liczbę różnic między punktami danych w przypadku danych wielowymiarowych? Wydaje mi się, że może już istnieć wiele rozwiązań, ale nie jestem …
Używamy plików cookie i innych technologii śledzenia w celu poprawy komfortu przeglądania naszej witryny, aby wyświetlać spersonalizowane treści i ukierunkowane reklamy, analizować ruch w naszej witrynie, i zrozumieć, skąd pochodzą nasi goście.
Kontynuując, wyrażasz zgodę na korzystanie z plików cookie i innych technologii śledzenia oraz potwierdzasz, że masz co najmniej 16 lat lub zgodę rodzica lub opiekuna.