Statystyki i duże zbiory danych

Pytania i odpowiedzi dla osób zainteresowanych statystyką, uczeniem maszynowym, analizą danych, eksploracją danych i wizualizacją danych



3
Praktyczny samouczek PCA z danymi
Wyszukiwanie w Internecie samouczka PCA daje tysiące wyników (nawet wideo). Wiele samouczków jest bardzo dobrych. Ale nie jestem w stanie znaleźć żadnego praktycznego przykładu, w którym wyjaśniono PCA przy użyciu niektórych zestawów danych, których mogę użyć do demonstracji. Potrzebuję samouczka, który zapewnia niewielki zestaw danych, który jest łatwy do wykreślenia …

1
Automatyczny wybór funkcji do wykrywania anomalii
Jaki jest najlepszy sposób automatycznego wybierania funkcji do wykrywania anomalii? Zazwyczaj traktuję Wykrywanie Anomalii jako algorytm, w którym cechy są wybierane przez ludzkich ekspertów: liczy się zakres wyjściowy (jak w „nienormalnym wejściu - nienormalnym wyjściu”), więc nawet przy wielu funkcjach można uzyskać znacznie mniejszy podzbiór, łącząc funkcje. Zakładając jednak, że …

2
Czym jest teraz Drosophila AI?
W połowie lat 60. XX wieku naukowcy nazywali szachy „ Drosophila AI”: podobnie jak mucha owocowa, gra w szachy była dostępna i stosunkowo prosty problem z eksperymentami, który jednak spowodował ważną wiedzę, bardziej złożone problemy. Teraz ludzie mówią, że „szachy to tylko problem wyszukiwania”, a „metody szachowe nie przyniosą większego …

1
Koc Markowa a normalna zależność w sieci bayesowskiej
Kiedy czytałem o sieci bayesowskiej, natrafiłem na termin „ koc Markowa ” i poważnie pomyliłem się z jego niezależnością w grafie sieci bayesowskiej. Koc Markowa krótko mówi, że każdy węzeł zależy tylko od jego rodziców, dzieci i rodziców dzieci [jest to szary obszar dla węzła A na zdjęciu]. Jakie jest …


4
Czy można uzyskać lepszy ANN, usuwając niektóre połączenia?
Zastanawiałem się, czy w pewnych okolicznościach jest możliwe, aby ANN działały lepiej, jeśli odetniesz na nich niektóre połączenia, na przykład: Konstruujesz jeden ANN, biorąc równolegle dwa wielowarstwowe ANN A i B (te same węzły wejściowe i wyjściowe), dodając kilka połączeń „komunikacyjnych” między ukrytymi warstwami A i B? Czy można uzyskać …


4
Jak konceptualizować błąd w modelu regresji?
Uczęszczam na klasę analizy danych i niektóre z moich głęboko zakorzenionych pomysłów są wstrząśnięte. Mianowicie idea, że ​​błąd (epsilon), a także jakakolwiek inna wariancja, odnosi się tylko (tak myślałem) do grupy (próbki lub całej populacji). Teraz uczymy się, że jednym z założeń regresji jest to, że wariancja jest „taka sama …




1
Rozszerzenie modeli klasy 2 na problemy klasy
Ten artykuł na temat Adaboost zawiera pewne sugestie i kod (strona 17) dotyczący rozszerzenia modeli 2-klasowych na problemy klasy K. Chciałbym uogólnić ten kod, tak że mogę łatwo podłączyć różne modele 2-klasowe i porównać wyniki. Ponieważ większość modeli klasyfikacji ma interfejs formuły i predictmetodę, niektóre z nich powinny być stosunkowo …


Korzystając z naszej strony potwierdzasz, że przeczytałeś(-aś) i rozumiesz nasze zasady używania plików cookie i zasady ochrony prywatności.
Licensed under cc by-sa 3.0 with attribution required.