Definisi Masalah

Aplikasi jejak karbon ‘EcoTrack’ mencatat menit penggunaan harian dari 15 pengguna aktif dalam satu minggu:

22, 25, 19, 30, 24, 21, 45, 23, 20, 26, 24, 22, 18, 27, 23

Carilah:

  1. Mean, median, dan modus data tersebut!
  2. Q1, Q3, dan IQR data tersebut!
  3. Varians dan standar deviasi data tersebut, dan tentukan apakah data ini tergolong bervariasi tinggi atau rendah?
  4. Hitung koefisien skewness Pearson dan tentukan arah kemencengannya!

Solusi

Sebelum memulai, data tersebut diubah menjadi vektor dan disimpan ke variabel bernama data dan diurutkan dengan fungsi sort().

data <- c(22, 25, 19, 30, 24, 21, 45, 23, 20, 26, 24, 22, 18, 27, 23)
data <- sort(data)

data
##  [1] 18 19 20 21 22 22 23 23 24 24 25 26 27 30 45

1. Mean, Median, dan Modus

data_mean   <- mean(data)
data_median <- median(data)

cat('Mean   : ', data_mean, '\n')
## Mean   :  24.6
cat('Median : ', data_median)
## Median :  23

Mean data tersebut adalah 24.6 dan median data tersebut adalah 23.

data_table <- table(data)
data_modus <- data_table[data_table == max(data_table)]

'Modus:'
## [1] "Modus:"
data_modus
## data
## 22 23 24 
##  2  2  2

Modus data tersebut adalah 22, 23, dan 24.

2. Q1, Q3, dan IQR

quantile(data, probs = c(0.25, 0.5, 0.75), type = 1)
## 25% 50% 75% 
##  21  23  26

3. Varians dan Standar Deviasi

var(data)
## [1] 41.54286
sd(data)
## [1] 6.445375

Standar deviasi 6 memiliki standar deviasi yang tinggi, yang berarti data memiliki variasi yang tinggi.

4. Skewness

library(moments)
skewness(data)
## [1] 2.212573

Skewness 2 berarti data memiliki distribusi positif.