Próbuję nauczyć się modelu regresji liniowej. Mam jednak pewne zamieszanie związane z normalizacją danych. Znormalizowałem cechy / predyktory do zera średniej i wariancji jednostkowej. Czy muszę zrobić to samo dla celu. Jeśli tak to dlaczego?
Czytam o twierdzeniu Guassa-Markowa na wikipedii i miałem nadzieję, że ktoś może mi pomóc ustalić główny punkt tego twierdzenia. Zakładamy, że model liniowy w postaci macierzy podaje: i szukamy NIEBIESKIEGO, .y= Xβ+ ηy=Xβ+η y = X\beta +\eta βˆβ^ \widehat\beta Zgodnie z tym , to, że etykieta "pozostałych" i przycisków "błąd". …
W przypadku tabeli awaryjnej 2 na 2 niektórzy powiedzieli, że dokładny test Fishera wykorzystuje liczbę w komórce (1,1) w tabeli jako statystykę testu, a pod hipotezą zerową będzie mieć rozkład hipergeometryczny.X1 , 1X1,1X_{1,1}X1 , 1X1,1X_{1,1} Niektórzy twierdzą, że jego statystyki testowe to gdzie jest średnią rozkładu hipergeometrycznego (wspomnianego powyżej) pod …
Jestem tylko ciekawy hipotezy zerowej testu U Manna-Whitneya. Często widzę, że stwierdzono, iż hipoteza zerowa mówi, że dwie populacje mają równe rozkłady. Ale myślę - gdybym miał dwie normalne populacje o tej samej średniej, ale niezwykle nierównej wariancji, test Manna-Whitneya prawdopodobnie nie wykryłby tej różnicy. Widziałem także, że stwierdzono, iż …
Muszę modelu regresji liniowej z jednym skategoryzowany (mężczyzn i kobiet), a jeden bezstopniowej .AAABBB Skonfigurowałem kody kontrastowe w R z options(contrasts=c("contr.sum","contr.poly")). A teraz mam sumy kwadratów typu III dla , B i ich interakcji (A: B) za pomocą .AAABBBdrop1(model, .~., test="F") Co ja skazani sposób sumy kwadratów jest obliczana dla …
Więc pracuję z modelami regresji logistycznej w R. Chociaż wciąż jestem nowy w statystyce, wydaje mi się, że do tej pory zrozumiałem trochę modeli regresji, ale wciąż coś mnie niepokoi: Patrząc na połączone zdjęcie, widać podsumowanie wydruków R dla przykładowego modelu, który stworzyłem. Model próbuje przewidzieć, czy wiadomość e-mail w …
Szukam dokładnego oszacowania średniej, która ma określoną właściwość. Mam zestaw elementów, dla których chcę obliczyć tę statystykę. Następnie dodaję nowe elementy pojedynczo i dla każdego dodatkowego elementu chciałbym ponownie obliczyć statystyki (znane również jako algorytm online). Chciałbym, aby to obliczenie aktualizacji było szybkie, najlepiej O (1), tzn. Nie zależy od …
Badam właściwości psychometryczne 10-elementowej miary samoopisu. Mam około 400 przypadków w dwóch niezależnych próbach. Przedmioty są uzupełniane w 4-punktowej skali Likerta. EFA wyraźnie wspiera rozwiązanie jednoczynnikowe (np. Pierwsza wartość własna powyżej 6, wszystkie inne poniżej 1), a wartość alfa Cronbacha jest dobra (np. 0,90). Żaden element nie ma niskiej korelacji …
gdy wkraczam w prognozowanie z modelami ARIMA, staram się zrozumieć, jak mogę poprawić prognozę opartą na dopasowaniu ARIMA do sezonowości i dryfu. Moje dane to następujące szeregi czasowe (ponad 3 lata, z wyraźnym trendem wzrostowym i widoczną sezonowością, która wydaje się nie być wspierana przez autokorelację w opóźnieniach 12, 24, …
Pracuję nad oprogramowaniem, które powinno określać lokalizacje świata rzeczywistego (np. Kamery prędkości) na podstawie kilku raportów opartych na GPS . Zgłaszając lokalizację użytkownik będzie jechał samochodem, dlatego raporty będą bardzo niedokładne. Aby rozwiązać ten problem, muszę grupować raporty dotyczące tej samej lokalizacji i obliczać średnią. Moje pytanie dotyczy sposobu grupowania …
Jakie są niektóre z dobrze znanych testów statystycznych do pomiaru dobroci dopasowania obserwowanych zmiennych losowych do rozkładu Poissona? Wiem, że test Kołmogorowa-Smirnowa jest jednym z nich, czy są jeszcze jakieś inne?
Korzystam z dynamicznego dopasowywania czasu, aby dopasować „zapytanie” i krzywą „szablonu” i jak dotąd mam rozsądny sukces, ale mam kilka podstawowych pytań: Oceniam „dopasowanie”, oceniając, czy wynik DTW jest mniejszy niż pewna wartość progowa, którą wymyślam heurystycznie. Czy to jest ogólne podejście do określania „dopasowania” za pomocą DTW? Jeśli nie, …
Czy stan (w szczególności rstan) ma wbudowane funkcje generowania predykcyjnych rozkładów bocznych? Nie jest trudno wygenerować rozkład ze stanu dopasowania, ale wolałbym nie wymyślać koła na nowo.
Wdrażam różne algorytmy, aby oszacować najlepszą liczbę pojemników do użycia w histogramach. Większość z tych, które wdrażam, opisano na stronie „Histogram” w Wikipedii w sekcji „ Liczba pojemników i szerokość ” *. Utknąłem na problem z formułą Doane'a: 1 + log(n) + log(1 + kurtosis(data) * sqrt(n / 6.)) gdzie …
(Nie mam pojęcia, jak to otagować, ponieważ nie jestem statystykiem i nie wiem, do czego to pole. Możesz dodać więcej odpowiednich tagów). Pracuję dla firmy produkującej oprogramowanie do analizy danych i potrzebujemy przyzwoitego zestawu danych do testowania i demonstrowania naszego najnowszego produktu. Nie możemy po prostu wypełnić bazy danych danymi …
Używamy plików cookie i innych technologii śledzenia w celu poprawy komfortu przeglądania naszej witryny, aby wyświetlać spersonalizowane treści i ukierunkowane reklamy, analizować ruch w naszej witrynie, i zrozumieć, skąd pochodzą nasi goście.
Kontynuując, wyrażasz zgodę na korzystanie z plików cookie i innych technologii śledzenia oraz potwierdzasz, że masz co najmniej 16 lat lub zgodę rodzica lub opiekuna.