Jak tytuł mówi, czy ktoś wie o dobrej, aktualnej książce, która ogólnie obejmuje wstępne przetwarzanie danych, a szczególnie techniki wykrywania wartości odstających? Książka nie musi skupiać się wyłącznie na tym, ale powinna wyczerpująco omawiać wyżej wymienione tematy - nie byłbym zadowolony z czegoś, co stanowi punkt wyjścia i cytuje listę …
Zamierzam udzielić nastolatkom godzinnego wykładu na temat statystyki. Prawdopodobnie zobaczę je tylko raz. Ten scenariusz może się powtarzać w kółko. Chciałbym dać im trochę aktywności, aby mogli doświadczyć statystyk. Ale jestem zmuszony to zrobić z ludźmi, którzy nie wiedzą nic o prawdopodobieństwie, wnioskowaniu statystycznym, analizie eksploracyjnej itp. Myślałem o przejściu …
Jeśli mam pewną stałą topologię nierekurencyjną (DAG) (ustalony zestaw węzłów i krawędzi, ale algorytm uczenia może zmieniać ciężar na krawędziach) neuronów esowatych z neuronami wejściowymi, które mogą przyjmować tylko łańcuchy w jako dane wejściowe i prowadzące do jednego wyniku (który wyprowadza rzeczywistą wartość, którą zaokrąglamy w górę do 1 lub …
Pracuję nad zestawem danych w celu oceny wpływu suszenia na aktywność mikrobiologiczną osadów. Celem jest ustalenie, czy wpływ suszenia różni się w zależności od rodzaju osadu i / lub głębokości osadu. Projekt eksperymentalny jest następujący: Pierwszy czynnik Osad odpowiada trzem rodzajom osadu (kodowany Sed1, Sed2, Sed3). Dla każdego rodzaju osadu …
Używam sieci neuronowej w R, aby zbudować NN z 14 wejściami i jednym wyjściem. Sieć buduję / trenuję kilka razy przy użyciu tych samych danych treningowych i tych samych architektury / ustawień sieciowych. Po wytworzeniu każdej sieci używam jej do samodzielnego zestawu danych testowych do obliczania niektórych przewidywanych wartości. Zauważyłem, …
Załóżmy, że mam trochę ponad 20 000 miesięcznych szeregów czasowych od stycznia do 05 grudnia. Każdy z nich reprezentuje globalne dane dotyczące sprzedaży innego produktu. Co jeśli zamiast obliczać prognozy dla każdego z nich, chciałbym skoncentrować się tylko na niewielkiej liczbie produktów, które „faktycznie mają znaczenie”? Mógłbym uszeregować te produkty …
Mam szereg czasowy danych o liczbie N = 14 w każdym punkcie czasowym i chcę obliczyć współczynnik Giniego i błąd standardowy dla tego oszacowania w każdym punkcie czasowym. Ponieważ mam tylko N = 14 zliczeń w każdym punkcie czasowym, przystąpiłem do obliczania wariancji scyzoryka, tj. z równania 7 Tomsona Ogwanga„Wygodna …
Dlaczego ktoś stosuje wiek i kwadrat do wieku jako zmienne towarzyszące w badaniu asocjacji genetycznej? Rozumiem użycie wieku, jeśli zostało ono zidentyfikowane jako znacząca zmienna towarzysząca, ale nie mam pojęcia, jak wykorzystać wiek kwadratowy.
Właśnie wykonałem (bardzo) prostą regresję liniową w Genstat i chciałbym zawrzeć zwięzłe i znaczące streszczenie wyników w moim raporcie. Nie jestem pewien, jakie dokładnie lub jakie informacje powinienem zawierać. Główne bity mojego wyjścia Genstat wyglądają tak: Summary of analysis Source d.f. s.s. m.s. v.r. F pr. Regression 1 8128935. 8128935. …
Jakie są dobre zasoby online lub offline, które dają przegląd historii statystyk i główny przełom w statystyce do tej pory? Przeczytałem stronę o historii statystyki na Wikipedii .
W tym przypadku „ciężar dowodów” (WOE) jest powszechnym terminem w opublikowanej literaturze naukowej i politycznej, najczęściej postrzeganym w kontekście oceny ryzyka, definiowanym przez: w(e:h)=logp(e|h)p(e|h¯¯¯)w(e:h)=logp(e|h)p(e|h¯)w(e : h) = \log\frac{p(e|h)}{p(e|\overline{h})} gdzie jest dowodem, h jest hipotezą.eeehhh Teraz chcę wiedzieć, jaka jest główna różnica w PMI (punktowe wzajemne informacje) pmi(e,h)=logp(e,h)p(e)∗p(h)pmi(e,h)=logp(e,h)p(e)∗p(h)pmi(e,h)=\log\frac{p(e,h)}{p(e)*p(h)}
Zamknięte. To pytanie jest nie na temat . Obecnie nie przyjmuje odpowiedzi. Chcesz poprawić to pytanie? Zaktualizuj pytanie, aby było tematem dotyczącym weryfikacji krzyżowej. Zamknięte 7 lat temu . Chciałbym przekonwertować zmienną czynnikową na zmienną numeryczną, ale as.numericnie daje oczekiwanego efektu. Poniżej otrzymuję statystyki podsumowujące dla numerycznej wersji zmiennej na …
Mam dwa zestawy danych, w których mam około 250 000 wartości dla 78 i 35 próbek. Niektóre próbki należą do rodziny, co może mieć wpływ na dane. Obliczyłem korelację par i waha się ona między 0,7 a 0,95, ale chciałbym wiedzieć, czy istnieje znacząca różnica w współczynnikach korelacji między rodziną …
W artykule na Wikipedii na temat przedziału wiarygodności napisano: W przypadku pojedynczego parametru i danych, które można podsumować za pomocą jednej wystarczającej statystyki, można wykazać, że wiarygodny przedział i przedział ufności zbiegną się, jeśli nieznany parametr jest parametrem lokalizacji (tj. Funkcja prawdopodobieństwa przekazania ma postać Pr (x | μ) = …
Używamy plików cookie i innych technologii śledzenia w celu poprawy komfortu przeglądania naszej witryny, aby wyświetlać spersonalizowane treści i ukierunkowane reklamy, analizować ruch w naszej witrynie, i zrozumieć, skąd pochodzą nasi goście.
Kontynuując, wyrażasz zgodę na korzystanie z plików cookie i innych technologii śledzenia oraz potwierdzasz, że masz co najmniej 16 lat lub zgodę rodzica lub opiekuna.