Folioevanzhou.org
← 返回 Tessera
原样32 行 × 4 列1 KB无缺失数据 2026-08-11

hair_eye_color

Counts of 592 statistics students cross-classified by hair colour, eye colour and sex.

One row represents one hair-eye-sex combination.

R package · 收录于 2026-08-11

下载 CSV · 1 KB
数据预览前 6 行
HairEyeSexFreq
BlackBrownMale32
BrownBrownMale53
RedBrownMale10
BlondBrownMale3
BlackBlueMale11
BrownBlueMale50
变量4 列
字符型3整数1
类型
#变量类型缺失统计
1HairHair colour.字符型—不同值 4Black · Brown · Red · Blond
2EyeEye colour.字符型—不同值 4Brown · Blue · Hazel · Green
3SexSex of the student.字符型—不同值 2Male · Female
4FreqkeyNumber of students falling in this combination.整数—min 2q1 —中位 10.0均值 18.5q3 —max 66.0
载入已写好列类型
library(readr)

hair_eye_color <- read_csv(
  "https://assets.evanzhou.org/tessera/csv/hair_eye_color.csv",
  col_types = cols(
    Hair = col_character(),
    Eye  = col_character(),
    Sex  = col_character(),
    Freq = col_integer()
  )
)
URLhttps://assets.evanzhou.org/tessera/csv/hair_eye_color.csv

Source

R 自带的 datasets::HairEyeColor。数据记录 592 名统计学学生的发色、眼睛颜色和性别组合;这里保留原始列联表展开后的长表形式,一行是一种组合及其频数。

CSV 由 R 4.5.1 自带数据原样展开并导出;变量水平与数据背景见 R 官方文档。

Use cases

  • 百分比堆叠柱:按发色比较眼睛颜色的构成
  • 马赛克图:用面积展示列联表中的联合频数
  • 热图:比较发色 × 眼睛颜色的频数矩阵
生成脚本R · 18 行
# 产物写到 ../csv/hair_eye_color.csv —— 脚本和 CSV 是 content/tessera/data/ 下固定的兄弟目录,
# 所以按脚本自身定位,不依赖你在哪个目录敲这条命令。csv/ 不进仓库(见 .gitignore)。
#
# Rscript 时路径在 --file= 里,source() 时在 sys.frame()$ofile 里,两种都要认:
# 只取其中一种的话,另一种跑法会静默地把 CSV 写到当前目录去。
script_dir <- local({
  arg <- grep("^--file=", commandArgs(trailingOnly = FALSE), value = TRUE)
  path <- if (length(arg)) sub("^--file=", "", arg[[1L]]) else sys.frame(1)$ofile
  dirname(normalizePath(path, mustWork = TRUE))
})
out_csv <- file.path(script_dir, "..", "csv", "hair_eye_color.csv")
dir.create(dirname(out_csv), recursive = TRUE, showWarnings = FALSE)

write.csv(
  as.data.frame(datasets::HairEyeColor),
  out_csv,
  row.names = FALSE
)

表中统计由 scripts/profile_dataset.py 于 2026-08-11 数出。