Tensorflow ma przykładowy samouczek na temat klasyfikowania CIFAR-10 . W samouczku średnia utrata entropii krzyżowej w partii jest zminimalizowana. def loss(logits, labels): """Add L2Loss to all the trainable variables. Add summary for for "Loss" and "Loss/avg". Args: logits: Logits from inference(). labels: Labels from distorted_inputs or inputs(). 1-D tensor of …
Moje pytanie może być głupie. Więc z góry przepraszam. Próbowałem użyć modelu GLOVE wstępnie przeszkolonego przez grupę NLP Stanforda ( link ). Zauważyłem jednak, że moje wyniki podobieństwa wykazały pewne liczby ujemne. To natychmiast skłoniło mnie do spojrzenia na plik danych słowo-wektor. Najwyraźniej wartości w wektorach słów mogły być ujemne. …
Czy możemy podać obrazy o zmiennej wielkości jako dane wejściowe do splotowej sieci neuronowej w celu wykrywania obiektów? Jeśli to możliwe, jak możemy to zrobić? Ale jeśli spróbujemy przyciąć obraz, stracimy część obrazu i jeśli spróbujemy zmienić jego rozmiar, wówczas jasność obrazu zostanie utracona. Czy to oznacza, że korzystanie z …
Przede wszystkim nie pytam o to: Dlaczego zerowa korelacja nie oznacza niezależności? Jest to rozwiązane (raczej ładnie) tutaj: /math/444408/why-does-zero-correlation-not-imply-independence Pytam o coś przeciwnego ... powiedzmy, że dwie zmienne są całkowicie niezależne od siebie. Czy nie mogliby przez przypadek mieć odrobinę korelacji? Czy nie powinno być ... niezależność oznacza BARDZO MAŁĄ …
(To pytanie może wydawać się bardziej odpowiednie dla filozofii SE. Mam nadzieję, że statystycy mogą wyjaśnić moje nieporozumienia na temat wypowiedzi Boxa i Shmueli, dlatego zamieszczam je tutaj). George Box (o sławie ARIMA) powiedział: „Wszystkie modele są błędne, ale niektóre są przydatne”. Galit Shmueli w swoim słynnym artykule „Wyjaśnić lub …
Jaka jest matematyczna definicja związku przyczynowego między dwiema zmiennymi losowymi? Biorąc pod uwagę próbkę ze wspólnego rozkładu dwóch zmiennych losowych XXX i YYY , kiedy powiedzielibyśmy, że XXX powoduje YYY ? Dla kontekstu czytam ten artykuł o odkryciu przyczynowym .
Wydaje się, że definicja nadzorowanego uczenia jest podzbiorem uczenia wzmacniającego, ze szczególnym rodzajem funkcji nagrody opartej na danych oznaczonych (w przeciwieństwie do innych informacji w środowisku). Czy to dokładne przedstawienie?
W mojej pracy, gdy osoby odnoszą się do „średniej” wartości zbioru danych, zwykle odnoszą się do średniej arytmetycznej (tj. „Średniej” lub „wartości oczekiwanej”). Gdybym podał średnią geometryczną , ludzie prawdopodobnie pomyśleliby, że jestem złośliwy lub nieprzydatny, ponieważ definicja „środka” jest znana z góry. Próbuję ustalić, czy istnieje wiele definicji „mediany” …
Właściwa reguła punktacji jest regułą, która jest maksymalizowana przez „prawdziwy” model i nie pozwala na „zabezpieczanie” lub granie w system (celowe zgłaszanie różnych wyników, jak to jest prawdziwe przekonanie modelu o poprawie wyniku). Wynik Briera jest prawidłowy, dokładność (proporcja sklasyfikowana poprawnie) jest niewłaściwa i często zniechęcana. Czasami widzę, że AUC …
Niech i będą niezależnymi ciągłymi zmiennymi losowymi wygenerowanymi z tej samej nieokreślonej postaci dystrybucyjnej, ale z uwzględnieniem różnych wartości parametrów. Interesuje mnie znalezienie formularza rozkładu parametrycznego, dla którego obowiązuje następujące prawdopodobieństwo próbkowania dla wszystkich dopuszczalnych wartości parametrów:X∼Dist(θX)X∼Dist(θX)X \sim \text{Dist}(\theta_X)Y∼Dist(θY)Y∼Dist(θY)Y \sim \text{Dist}(\theta_Y) P(X>Y|θX,θY)=θ2Xθ2X+θ2Y.P(X>Y|θX,θY)=θX2θX2+θY2.\mathbb{P}(X > Y| \theta_X, \theta_Y) = \frac{\theta_X^2}{\theta_X^2 + \theta_Y^2}. …
To pytanie zostało zainspirowane dwiema niedawnymi interakcjami, które miałem, jedną tutaj w CV , drugą w ekonomics.se. Tam miałem wysłana odpowiedź do znanego „Koperta Paradox” (Pamiętaj, a nie jak w „poprawnej odpowiedzi”, ale jako odpowiedź płynącą z określonych założeń o strukturze sytuacji). Po pewnym czasie użytkownik opublikował krytyczny komentarz, a …
Biorąc pod uwagę trzy wektory , i , jest możliwe, że korelacja pomiędzy i , i i i są negatywne? Czy to możliwe?b c a b a c b caaabbbcccaaabbbaaacccbbbccc corr ( a , b ) < 0corr(a,c)<0corr(b,c)<0corr(a,b)<0corr(a,c)<0corr(b,c)<0\begin{align} \text{corr}(a,b) < 0\\ \text{corr}(a,c) < 0 \\ \text{corr}(b,c) < 0\\ \end{align}
Jakie było pierwsze wyprowadzenie rozkładu normalnego, czy możesz odtworzyć to wyprowadzenie, a także wyjaśnić je w kontekście historycznym ? Chodzi mi o to, że gdyby ludzkość zapomniała o normalnym rozkładzie, jaki jest najbardziej prawdopodobny sposób, aby go odkryć na nowo i jakie byłoby najbardziej prawdopodobne pochodzenie? Sądzę, że pierwsze pochodne …
Próbuję użyć straty kwadratowej, aby dokonać klasyfikacji binarnej na zestawie danych zabawki. Korzystam z mtcarszestawu danych, wykorzystuję milę na galon i wagę, aby przewidzieć rodzaj transmisji. Poniższy wykres pokazuje dwa typy danych typu transmisji w różnych kolorach oraz granicę decyzji wygenerowaną przez inną funkcję strat. Kwadratowa strata wynosi ∑i(yi−pi)2∑ja(yja-pja)2)\sum_i (y_i-p_i)^2 …
Używamy plików cookie i innych technologii śledzenia w celu poprawy komfortu przeglądania naszej witryny, aby wyświetlać spersonalizowane treści i ukierunkowane reklamy, analizować ruch w naszej witrynie, i zrozumieć, skąd pochodzą nasi goście.
Kontynuując, wyrażasz zgodę na korzystanie z plików cookie i innych technologii śledzenia oraz potwierdzasz, że masz co najmniej 16 lat lub zgodę rodzica lub opiekuna.