pandas를 이용해서 DataFrame 읽기

info()로 dataframe 정보 보기
보고 나서 전처리 해주기

필요없는 정보 drop()

axis=0은 row, axis=1은 col

열 명중에 바꾸고 싶은 것들 알아보기 쉽게 바꾸기

영어로 되어 있어서 직관적인 분석이 불가능

영어를 한국어로 바꾸고 isnull()을 사용해서 null값 알 수 있음
만약, null값을 남기게 된다면 합계나 평균 같은 통곗값에서 영향을 미치게 됨.
ex) 100명 중에 80명의 데이터만 있는데 나머지 null값을 어떻게 처리해야 하는지 데이터들마다 맞는 처리 방법이 있음
제외하고 80명끼리만 통계를 낼지, 20명을 0으로 처리하고 통계를 낼지 결정해야됨
위치 기반 인덱싱
df.iloc[:, -1]
명칭 기반 인덱싱
df.loc['one', 'name']
하지만 대부분 DataFrame['칼럼명']으로 출력함
행과 열을 함께 사용해서 추출해야되면 사용하기도 함
titanic_groupby = titanic_df.groupby('Pclass').count()
titanic_groupby
Pclass 기준으로 그루핑하고

개수 counting
핵심만 콕콕 짚어줘서 고마워요 🫡 앞으로 이거보고 복습 할게요!!