Załóżmy, że masz plik data.frame taki jak ten:
x <- data.frame(v1=1:20,v2=1:20,v3=1:20,v4=letters[1:20])
Jak wybrałbyś tylko te kolumny w x, które są numeryczne?
EDYCJA: zaktualizowano, aby uniknąć użycia niewłaściwego doradztwa sapply
.
Ponieważ ramka danych jest listą, możemy użyć funkcji zastosowania listy:
nums <- unlist(lapply(x, is.numeric))
Następnie standardowe podzbiór
x[ , nums]
## don't use sapply, even though it's less code
## nums <- sapply(x, is.numeric)
Dla bardziej idiomatycznego nowoczesnego R. poleciłbym teraz
x[ , purrr::map_lgl(x, is.numeric)]
Mniej kluczowania, mniej odzwierciedlające szczególne dziwactwa R, a także prostsze i solidniejsze w użyciu w bazach danych opartych na bazie danych:
dplyr::select_if(x, is.numeric)
x[nums]
lub teżx[sapply(x,is.numeric)]
działa. I zawsze wracajądata.frame
. Porównajx[1]
vsx[,1]
- po pierwszedata.frame
, drugi to wektor. Jeśli chcesz zapobiec konwersji, musisz użyćx[, 1, drop=FALSE]
.undefined columns selected
. Jak tego uniknąć?tryCatch()
sobie z tym poradzić. Proszę rozważyć otwarcie nowego pytania.Funkcja pakietu dplyr
select_if(
) jest eleganckim rozwiązaniem:źródło
Filter()
z pakietu podstawowego jest idealną funkcją dla tego przypadku użycia: po prostu musisz zakodować:Jest także znacznie szybszy niż
select_if()
:zwraca (na moim komputerze) medianę 60 mikrosekund dla
Filter
i 21 000 mikrosekund dlaselect_if
(350x szybciej).źródło
Filter()
nie działa, to zamiana, np.Filter(is.numeric,iris) <- 0.5*Filter(is.numeric,iris)
Nie zadziała.jeśli interesują Cię tylko nazwy kolumn, użyj tego:
źródło
To alternatywny kod do innych odpowiedzi:
z
data.table
źródło
źródło
Biblioteka PCAmixdata ma funkcję splitmix, która dzieli ilościową (dane liczbowe) i jakościową (dane kategorialne) daną ramkę danych „YourDataframe”, jak pokazano poniżej:
źródło
Innym sposobem może być:
źródło
Jeśli masz wiele zmiennych czynnikowych, możesz użyć
select_if
funkcji funtion. zainstaluj pakiety dplyr. Istnieje wiele funkcji oddzielających dane poprzez spełnienie warunku. możesz ustawić warunki.Użyj w ten sposób.
źródło
To nie odpowiada bezpośrednio na pytanie, ale może być bardzo przydatne, szczególnie jeśli potrzebujesz czegoś takiego jak wszystkie kolumny numeryczne z wyjątkiem kolumny id i zmiennej zależnej.
źródło