Regner ut antall og andel manglende observasjoner for en variabel. Tar inn et datasett og en variabel det skal beregnes kompletthet for.
Value
Returnerer en tibble med følgende kolonner:
grupperingsvariabel - Hvis inndata er gruppert vil grupperingsvariabel være
med i utdata.
Variabel - Navn på variabel det er beregnet kompletthet for.
Totalt_antall - Totalt antall observasjoner per gruppe i inndata
.
Antall_na - Antall observasjoner som er NA i inndata.
Andel_na - Andel observasjoner som er NA i inndata.
Examples
# Pakke for bruk av tibble-objekt og rør-operatoren
library(dplyr)
# Ugrupperte inndata:
d = tibble(
pas_id = c(1, 2, 3, 4, 5, 6),
sykehus = c("HUS", "HUS", "SVG", "SVG", "SVG", "OUS"),
var_1 = c(1, 2, -1, 99, NA, 5)
)
beregn_kompletthet(data = d, variabel = "var_1")
#> # A tibble: 1 × 4
#> variabel totalt_antall antall_na andel_na
#> <chr> <int> <int> <dbl>
#> 1 var_1 6 1 0.167
# Grupperte inndata:
d = tibble(
pas_id = c(1, 2, 3, 4, 5, 6),
sykehus = c("HUS", "HUS", "SVG", "SVG", "SVG", "OUS"),
var_1 = c(1, 2, -1, 99, NA, 5)
) |>
group_by(sykehus)
beregn_kompletthet(data = d, variabel = "var_1")
#> # A tibble: 3 × 5
#> sykehus variabel totalt_antall antall_na andel_na
#> <chr> <chr> <int> <int> <dbl>
#> 1 SVG var_1 3 1 0.333
#> 2 HUS var_1 2 0 0
#> 3 OUS var_1 1 0 0