오늘의 학습 요약EDA의 표준 흐름인 데이터 로드, 구조 파악, 기초 통계량 확인, 결측·중복 점검, 변수별 분포 분석, 변수 간 관계 분석, 상관관계 분석 순서를 타이타닉 데이터셋에 적용하였다. 목표 변수는 생존 여부(survived)로 설정하고 성별, 객실 등급, 승선 항구, 나이, 요금 등의 변수를 중심으로 분석을 진행하였다.분석 도구는 pandas의 describe, value_counts, groupby, crosstab과 seaborn의 countplot, histplot, boxplot, heatmap을 조합하였다. 이어서 sibsp, parch를 합산한 family_size, 15세 이하 여부를 나타내는 is_child, pd.cut으로 구간화한 age_group 파생변수를 생성하고 그룹별..