업데이트 중
빅분기 실기를 10일 남기고 시작한 벼락치기.
일단 함수를 잘 기억해두는게 시간단축에 좋을듯 하다.
pandas.read_csv('path', encoding='euc-kr')df.skew()df.kurt()Q1 = df['column_name'].describe()["25%"]
Q3 = df['column_name'].describe()["75%"]# 도시별 데이터의 이름 딕셔너리 생성
keys = data['city'].unique()
medians = {}
# 도시이름 : 값 저장
for i in keys:
medians[i] = data.groupby(i).median()
#value의 na를 도시별 중위수로 map을 활용하여 채우기
df['value'].fillna(df['city'].map(medians))로그 변환, 제곱근 변환
# log 변환
df[`new_column_name`] = Numpy.log(df['column_name'])
# 제곱근 변환
df[`new_column_name`] = Numpy.sqrt(df['column_name'])
소수점 올림, 내림, 버림
#올림
np.ceil(x)
#내림
np.floor(x)
#버림
np.trunc(x)
np.getdummies(df[column_name]) def brand_group(series):
if series==1:
return 1
elif series==2:
return 2
df['re_brand'] = df['brand'].apply(brand_groups)