Rozumiem różnicę między k medoidą a k oznacza średnią. Ale czy możesz podać mi przykład z małym zestawem danych, w którym wyjście medoidy k jest inne niż k oznacza wyjście.
Chcę wdrożyć przyrostową regresję procesu gaussowskiego za pomocą przesuwanego okna nad punktami danych, które docierają jeden po drugim przez strumień. Pozwolić reddoznacz wymiarowość przestrzeni wejściowej. Więc każdy punkt danychxjaxix_i ma redd liczba elementów. Pozwolić nnn być wielkości przesuwanego okna. Aby dokonać prognoz, muszę obliczyć odwrotność macierzy gramowej K.KK, gdzie K.I …
Badając dwie niezależne próbki, powiedziano nam, że patrzymy na „różnicę dwóch średnich”. Oznacza to, że bierzemy średnią z populacji 1 ( ) i odejmujemy od niej średnią z populacji 2 ( ). Nasza „różnica dwóch średnich” to ( - ).y¯1y¯1\bar y_1y¯2)y¯2)\bar y_2y¯1y¯1\bar y_1y¯2)y¯2)\bar y_2 Badając sparowane próbki, powiedziano nam, że …
Mam szereg czasowy ytyty_ti chciałbym modelować to jako proces ARFIMA (alias FARIMA). Jeśli jest zintegrowane z (ułamkowym) rzędem , chciałbym różnicować go ułamkowo, aby stał się nieruchomy.ytyty_trered Pytanie : czy następujący wzór definiujący różnicowanie ułamkowe jest poprawny? Δreyt: =yt- dyt - 1+re( d- 1 )2 !yt - 2-re( d- 1 …
Jaka jest różnica między rotacją varimax a rotacją eliminacji w analizie czynnikowej? Jestem również zdezorientowany co do związku między analizą głównych składników, rotacją varimax i eksploracyjną analizą czynnikową, zarówno w teorii, jak i w SPSS. W jaki sposób są one powiązane?
Zastosowałem test DW do mojego modelu regresji w R i otrzymałem statystykę testu DW wynoszącą 1,78 i wartość p 2,2e-16 = 0. Czy to oznacza, że nie ma autokorelacji między resztami, ponieważ stat jest bliski 2 z małą wartością p, czy to oznacza, że chociaż stat jest bliski 2, wartość …
Rozważ prostą regresję (nie zakłada się normalności): gdzie jest ze średnią i odchyleniem standardowym . Są najmniej kwadratowe Szacunki i nieskorelowane?Yja= a + bXja+mija,Yi=a+bXi+ei,Y_i = a + b X_i + e_i,mijaeie_i000σσ\sigmazaaabbb
Christopher Bishop pisze w swojej książce Pattern Recognition and Machine Learning dowód, że każdy kolejny główny składnik maksymalizuje wariancję projekcji do jednego wymiaru, po tym jak dane zostaną rzutowane do przestrzeni ortogonalnej na wcześniej wybrane komponenty. Inne pokazują podobne dowody. Dowodzi to jednak tylko, że każdy kolejny element jest najlepszym …
Rozumiem, że miara f (oparta na precyzji i przywołaniu) jest oszacowaniem dokładności klasyfikatora. Ponadto, gdy mamy niezrównoważony zestaw danych , f-miara jest ważniejsza od dokładności . Mam proste pytanie (które dotyczy bardziej prawidłowej terminologii niż technologii). Mam niezrównoważony zestaw danych i używam miary F w swoich eksperymentach. Mam zamiar napisać …
Mam pytanie dotyczące prawidłowej dystrybucji do użycia przy tworzeniu modelu z moimi danymi. Przeprowadziłem inwentaryzację lasu z 50 działkami, każda działka ma wymiary 20 x 50 m. Dla każdej działki oszacowałem procent korony drzew, która osłania ziemię. Każda działka ma jedną wartość procentową pokrycia baldachimu. Zakres procentowy wynosi od 0 …
Zaimplementowałem następującą funkcję do obliczania entropii: from math import log def calc_entropy(probs): my_sum = 0 for p in probs: if p > 0: my_sum += p * log(p, 2) return - my_sum Wynik: >>> calc_entropy([1/7.0, 1/7.0, 5/7.0]) 1.1488348542809168 >>> from scipy.stats import entropy # using a built-in package # give …
Próbowałem pogłębić wiedzę na temat statystyk, szczególnie w odniesieniu do określania wielkości próby i analizy mocy statystycznej. Ale wydaje się, że im więcej czytam, tym więcej muszę czytać. W każdym razie znalazłem narzędzie o nazwie G * Power, które wydaje się robić wszystko, czego potrzebuję, ale mam problem ze zrozumieniem …
Jako założenie regresji liniowej normalność rozkładu błędu jest czasami błędnie „rozszerzana” lub interpretowana jako potrzeba normalności y lub x. Czy można skonstruować scenariusz / zestaw danych, w którym X i Y są nienormalne, ale wartość błędu jest, a zatem uzyskane szacunki regresji liniowej są prawidłowe?
Korzystając z dwójki wartości uzyskanych w wyniku analizy głównego składnika, możliwe jest zbadanie zmiennych objaśniających, które składają się na każdy podstawowy składnik. Czy jest to również możliwe w przypadku liniowej analizy dyskryminacyjnej? Podane przykłady wykorzystują Dane to „Dane Iris Edgara Andersona” ( http://en.wikipedia.org/wiki/Iris_flower_data_set ). Oto dane tęczówki : id SLength …
Napisałem program do symulacji występowi karty Losowo. Każda karta jest ponumerowana, kolor odpowiada, od CLUBS, DIAMONDS, HEARTS, SPADESrangi od dwóch do dziesięciu, a następnie Jacka, Królowej, Króla i Asa. Zatem Two of Clubs ma liczbę 1, Three of Clubs 2 ... As trefl wynosi 13 ... As pik wynosi 52. …
Używamy plików cookie i innych technologii śledzenia w celu poprawy komfortu przeglądania naszej witryny, aby wyświetlać spersonalizowane treści i ukierunkowane reklamy, analizować ruch w naszej witrynie, i zrozumieć, skąd pochodzą nasi goście.
Kontynuując, wyrażasz zgodę na korzystanie z plików cookie i innych technologii śledzenia oraz potwierdzasz, że masz co najmniej 16 lat lub zgodę rodzica lub opiekuna.