Mam zestaw danych ascii, który składa się z trzech kolumn, ale tylko dwie ostatnie są danymi rzeczywistymi. Teraz chcę utworzyć dotchart danych za pomocą read.csv(file = "result1", sep= " "). R odczytuje wszystkie trzy kolumny. Jak tego uniknąć?
Mam zestaw danych ascii, który składa się z trzech kolumn, ale tylko dwie ostatnie są danymi rzeczywistymi. Teraz chcę utworzyć dotchart danych za pomocą read.csv(file = "result1", sep= " "). R odczytuje wszystkie trzy kolumny. Jak tego uniknąć?
Odpowiedzi:
Możesz użyć colClassesargumentu, read.csvaby wybrać żądane kolumny. W takim przypadku możesz ustawić colClassesnac("NULL", NA, NA)
read.csv(file="result1", sep=" ", colClasses=c("NULL", NA, NA))
Mówiąc bardziej ogólnie, można użyć colClasses, aby określić poszczególne typy kolumn; NAoznacza zastosowanie domyślnego podejścia polegającego na próbie ustalenia, która kolumna jest automatycznie. Aby uzyskać read.csvwięcej informacji, zobacz stronę pomocy .
Inną opcją jest odczytanie całego pliku, ale zachowaj tylko dwie kolumny, np .:
read.csv(file = "result1", sep = " ")[ ,1:2]
lub używając nazw kolumn, np. jeśli kolumny mają nazwy „col1, col2, col3”
read.csv(file = "result1", sep = " ")[ ,c('col1', 'col2')]
Ten zajmuje mniej czasu w porównaniu do podanych odpowiedzi
library(data.table)
fread(file="result1", sep=" ", colClasses=c("NULL", NA, NA))