Statystyki i duże zbiory danych

Pytania i odpowiedzi dla osób zainteresowanych statystyką, uczeniem maszynowym, analizą danych, eksploracją danych i wizualizacją danych

2
Co oznaczałby przedział ufności wokół przewidywanej wartości z modelu efektów mieszanych?
Patrzyłem na tę stronęi zauważyłem metody przedziałów ufności dla lme ​​i lmer w R. Dla tych, którzy nie znają R, są to funkcje do generowania mieszanych efektów lub modeli wielopoziomowych. Jeśli mam ustalone efekty w projekcie przypominającym powtarzane miary, co oznaczałoby przedział ufności wokół przewidywanej wartości (podobny do średniej)? Rozumiem, …

9
Oprogramowanie do wizualizacji dla grupowania
Zablokowana . To pytanie i odpowiedzi są zablokowane, ponieważ pytanie jest nie na temat, ale ma znaczenie historyczne. Obecnie nie akceptuje nowych odpowiedzi ani interakcji. Chcę zebrać ~ 22000 punktów. Wiele algorytmów klastrowania działa lepiej przy wstępnych domysłach o wyższej jakości. Jakie istnieją narzędzia, które mogą dać mi dobry pogląd …



4
Masz pytania dotyczące dywergencji KL?
Porównuję dwie rozkłady z rozbieżnością KL, która zwraca mi niestandaryzowaną liczbę, która zgodnie z tym, co czytam o tej mierze, jest ilością informacji potrzebną do przekształcenia jednej hipotezy w drugą. Mam dwa pytania: a) Czy istnieje sposób kwantyfikacji dywergencji KL, aby miał bardziej sensowną interpretację, np. wielkość efektu lub R …




3
Czy wyniki testów naprawdę mają normalny rozkład?
Próbowałem dowiedzieć się, które dystrybucje używać w GLM, i trochę się zastanawiam, kiedy użyć normalnej dystrybucji. W jednej części mojego podręcznika jest napisane, że rozkład normalny może być dobry do modelowania wyników egzaminów. W następnej części pyta się, jaka dystrybucja byłaby odpowiednia do modelowania roszczenia z tytułu ubezpieczenia samochodu. Tym …

5
Model efektów mieszanych: Porównaj losową składową wariancji między poziomami zmiennej grupującej
Załóżmy, że mam uczestników, z których każdy daje odpowiedź 20 razy, 10 w jednym stanie i 10 w innym. Dopasowuję liniowy model efektów mieszanych porównujący w każdych warunkach. Oto powtarzalny przykład symulujący tę sytuację za pomocą pakietu w :Y TNN.NYYYYYYlme4R library(lme4) fml <- "~ condition + (condition | participant_id)" d …


3
Strojenie hiper parametrów: Wyszukiwanie losowe a optymalizacja Bayesa
Wiemy zatem, że wyszukiwanie losowe działa lepiej niż wyszukiwanie siatki, ale nowszym podejściem jest optymalizacja Bayesa (przy użyciu procesów gaussowskich). Sprawdziłem porównanie między nimi i nic nie znalazłem. Wiem, że w cs231n Stanforda wspominają tylko o losowym wyszukiwaniu, ale możliwe jest, że chcieli zachować prostotę. Moje pytanie brzmi: które podejście …

1
Caret glmnet vs cv.glmnet
Wydaje się, że istnieje wiele zamieszania w porównaniu używania glmnetwewnątrz w caretcelu znalezienia optymalnej lambdy i korzystania cv.glmnetz tego samego zadania. Zadano wiele pytań, np .: Model klasyfikacji train.glmnet vs. cv.glmnet? Jaki jest właściwy sposób używania glmnet z karetką? Cross-validation `glmnet` za pomocą` caret` ale nie udzielono odpowiedzi, co może …


1
Różnica między modelem przechwytywania z regresem logistycznym lub bez niego
Lubię rozumieć różnicę między modelem przechwytywania z regresem logistycznym lub bez niego Czy jest między nimi jakaś różnica oprócz tego, że przy przecinaniu współczynniki uwzględniają log (iloraz szans) w stosunku do grupy wyjściowej, a bez przecięcia uwzględniają log (szanse)? z tego, co widziałem, współczynniki są takie same w obu przypadkach, …

Korzystając z naszej strony potwierdzasz, że przeczytałeś(-aś) i rozumiesz nasze zasady używania plików cookie i zasady ochrony prywatności.
Licensed under cc by-sa 3.0 with attribution required.