Algorytmy uczenia maszynowego budują model danych szkoleniowych. Termin „uczenie maszynowe” jest niejasno zdefiniowany; obejmuje to tak zwane uczenie statystyczne, uczenie wzmacniające, uczenie bez nadzoru itp. ZAWSZE DODAJ SZCZEGÓŁOWĄ TAGĘ.
Powiedzmy, że chcę utworzyć klasyfikator logistyczny do filmu M. Moje funkcje to coś w rodzaju wieku osoby, płci, zawodu, lokalizacji. Więc zestaw treningowy wyglądałby tak: Wiek Płeć Zawód Lokalizacja Lubię (1) / Nie lubię (0) 23 M Oprogramowanie US 1 24 F Doctor UK 0 i tak dalej .... Teraz …
Mam dane czasowe częstotliwości aktywności. Chcę zidentyfikować klastry w danych, które wskazują różne okresy o podobnych poziomach aktywności. Idealnie chcę zidentyfikować klastry bez określania liczby klastrów a priori. Jakie są odpowiednie techniki klastrowania? Jeśli moje pytanie nie zawiera wystarczającej ilości informacji, aby odpowiedzieć, jakie informacje muszę podać, aby określić odpowiednie …
Rozumiem teoretycznie (w pewnym sensie), jak by one działały, ale nie jestem pewien, jak właściwie korzystać z metody złożonej (takiej jak głosowanie, ważone mieszanki itp.). Jakie są dobre zasoby do wdrażania metod zespołowych? Czy są jakieś szczególne zasoby dotyczące implementacji w Pythonie? EDYTOWAĆ: Aby wyjaśnić niektóre na podstawie dyskusji na …
Zapraszam do zastępowania „czasopism” innym użytecznym portalem wiedzy. Jestem zainteresowany obserwowaniem nowych osiągnięć w uczeniu maszynowym, z myślą o praktycznych zastosowaniach. Nie jestem naukowcem, który chce publikować własne prace (przynajmniej nie w tej dziedzinie), ale chcę mieć świadomość potencjalnych nowych algorytmów lub sztuczek, które byłyby przydatne na poziomie praktycznym. Jedynym …
Czy istnieją jakieś szybkie alternatywy dla algorytmu EM do uczenia się modeli z ukrytymi zmiennymi (zwłaszcza pLSA)? Nie przeszkadza mi poświęcanie precyzji na rzecz prędkości.
Widziałem odniesienia do nauki bayesowskiej teorii prawdopodobieństwa w języku R i zastanawiałem się, czy jest czegoś takiego, być może konkretnie w Pythonie? Skoncentrowany na nauce Bayesowskiej teorii prawdopodobieństwa, wnioskowania, szacowania maksymalnego prawdopodobieństwa, modeli graficznych i tym podobnych?
Kilka lat temu odbyłem kurs prawdopodobieństwa na uniwersytecie, ale teraz przechodzę przez algorytmy uczenia maszynowego, a niektóre matematyki są po prostu oszałamiające. Właśnie teraz uczę się algorytmu EM (maksymalizacja oczekiwań) i wydaje się, że istnieje duże rozróżnienie między tym, co jest wymagane, a tym, co mam. Nie pytam o książkę …
Czytałem o wielu algorytmów rozwiązywania problemów n uzbrojonych bandyckie jak -greedy, Softmax i UCB1, ale mam pewne problemy z sortowaniem przez co jest najlepsze podejście do minimalizacji żal.ϵϵ\epsilon Czy istnieje znany optymalny algorytm rozwiązywania problemu n-uzbrojonego bandyty? Czy istnieje wybór algorytmu, który wydaje się działać najlepiej w praktyce?
Załóżmy, że możesz obserwować „dopasowania” między kupującymi a sprzedającymi na rynku. Możesz także obserwować cechy zarówno kupujących, jak i sprzedających, których chciałbyś użyć do przewidywania przyszłych meczów i przedstawiać rekomendacje obu stronom rynku. Dla uproszczenia załóżmy, że istnieje N nabywców i N sprzedawców oraz że każdy z nich znajdzie dopasowanie. …
Chciałbym uzyskać współczynniki dla problemu LASSO | | Y- Xβ| | +λ | | β| |1.||Y−Xβ||+λ||β||1.||Y-X\beta||+\lambda ||\beta||_1. Problem polega na tym, że funkcje glmnet i lars dają różne odpowiedzi. Dla funkcji glmnet proszę o współczynniki λ / | | Y| |λ/||Y||\lambda/||Y||zamiast po prostu λλ\lambda , ale wciąż otrzymuję różne odpowiedzi. …
Używam Singular Value Decomposition jako techniki redukcji wymiarowości. Biorąc pod uwagę Nwektory wymiaru D, ideą jest przedstawienie cech w przekształconej przestrzeni o nieskorelowanych wymiarach, która kondensuje większość informacji danych w wektorach własnych tej przestrzeni w malejącym porządku ważności. Teraz próbuję zastosować tę procedurę do danych szeregów czasowych. Problem polega na …
Załóżmy, że nasz zestaw danych zawiera 1 milion przykładów, tj. , i chcemy użyć opadania gradientu, aby przeprowadzić regresję logistyczną lub liniową na tym zestawie danych.x1,…,x106x1,…,x106x_1, \ldots, x_{10^6} Co to jest z metodą opadania gradientu, która sprawia, że jest nieefektywna? Przypomnijmy, że krok opadania gradientu w czasie jest określony przez:ttt …
Klasyfikator Naive Bayes jest klasyfikatorem, który przypisuje przedmioty do klasy oparciu o maksymalizację tylnego dla członkostwa w klasie i zakłada, że cechy przedmiotów są niezależne.C P ( C | x )xxxCCCP(C|x)P(C|x)P(C|x) Strata 0-1 to strata, która przypisuje każdej błędnej klasyfikacji stratę „1”, a stratę „0” dowolnej poprawnej klasyfikacji. Często czytam …
Funkcja celu w głównej analizie składników (PCA) polega na minimalizowaniu błędu rekonstrukcji w normie L2 (patrz sekcja 2.12 tutaj . Inny pogląd stara się zmaksymalizować wariancję projekcji. Mamy też doskonały post tutaj: Jaka jest funkcja celu PCA ? ). Moje pytanie brzmi: czy wypukła jest optymalizacja PCA? (Znalazłem tutaj kilka …
Jestem raczej nowy w dziedzinie procesów gaussowskich i ich zastosowania w uczeniu maszynowym. Czytam i słyszę o funkcjach kowariancji będących główną atrakcją tych metod. Czy ktoś mógłby zatem w intuicyjny sposób wyjaśnić, co dzieje się w tych funkcjach kowariancji? W przeciwnym razie możesz wskazać konkretny samouczek lub dokument wyjaśniający je.
Używamy plików cookie i innych technologii śledzenia w celu poprawy komfortu przeglądania naszej witryny, aby wyświetlać spersonalizowane treści i ukierunkowane reklamy, analizować ruch w naszej witrynie, i zrozumieć, skąd pochodzą nasi goście.
Kontynuując, wyrażasz zgodę na korzystanie z plików cookie i innych technologii śledzenia oraz potwierdzasz, że masz co najmniej 16 lat lub zgodę rodzica lub opiekuna.