Skip to contents

[Experimental]

Regner ut antall og andel manglende observasjoner for en variabel. Tar inn et datasett og en variabel det skal beregnes kompletthet for.

Usage

beregn_kompletthet(data, variabel)

Arguments

data

Tibble/data.frame som inneholder variabel det skal beregnes kompletthet for.

variabel

Tekststreng med navn på variabel det skal beregnes kompletthet for.

Value

Returnerer en tibble med følgende kolonner:
grupperingsvariabel - Hvis inndata er gruppert vil grupperingsvariabel være med i utdata.
Variabel - Navn på variabel det er beregnet kompletthet for.
Totalt_antall - Totalt antall observasjoner per gruppe i inndata
. Antall_na - Antall observasjoner som er NA i inndata.
Andel_na - Andel observasjoner som er NA i inndata.

Examples

# Pakke for bruk av tibble-objekt og rør-operatoren
library(dplyr)

# Ugrupperte inndata:
d = tibble(
  pas_id = c(1, 2, 3, 4, 5, 6),
  sykehus = c("HUS", "HUS", "SVG", "SVG", "SVG", "OUS"),
  var_1 = c(1, 2, -1, 99, NA, 5)
)
beregn_kompletthet(data = d, variabel = "var_1")
#> # A tibble: 1 × 4
#>   variabel totalt_antall antall_na andel_na
#>   <chr>            <int>     <int>    <dbl>
#> 1 var_1                6         1    0.167

# Grupperte inndata:
d = tibble(
  pas_id = c(1, 2, 3, 4, 5, 6),
  sykehus = c("HUS", "HUS", "SVG", "SVG", "SVG", "OUS"),
  var_1 = c(1, 2, -1, 99, NA, 5)
) |>
  group_by(sykehus)

beregn_kompletthet(data = d, variabel = "var_1")
#> # A tibble: 3 × 5
#>   sykehus variabel totalt_antall antall_na andel_na
#>   <chr>   <chr>            <int>     <int>    <dbl>
#> 1 SVG     var_1                3         1    0.333
#> 2 HUS     var_1                2         0    0    
#> 3 OUS     var_1                1         0    0